{"as_of":"2026-08-08T02:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c02b6b2ea247279a7b2ed91682631c8c55ab6969e9f0b32c1a9f7cda8fe4c06a","coverage":[{"denominator":84,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":84,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:12:26.426274Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.17131/citation-record","integrity":"/paper/2505.17131/integrity","json":"/paper/2505.17131/citation-record.json","paper":"/paper/2505.17131"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:17.646921Z","title":"https://aws.amazon.com/bedrock, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:17.646921Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:c097ea754b557675b1996d264394383225bcf68c7aa7b5aa317e0d214ef75d9e","observation_id":"e4bdad71-1fe1-4c64-bfdc-823656e5396c","resolution":{"observed_at":"2026-08-07T15:12:17.646921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:17.746789Z","title":"https://www.deepseek.com, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:17.746789Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:e62712b569c4292f69340419747995189063cc532560dd7963240b63f83b387b","observation_id":"fe12084b-f7d6-471a-ae69-fc55aedc4e25","resolution":{"observed_at":"2026-08-07T15:12:17.746789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:17.883888Z","title":"https://aistudio.google.com, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:17.883888Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:fd8851f4549eed716768a99cc0527733d90e9a71f5cb7471354e02c5e11cd70e","observation_id":"d3263a64-e21f-4c0a-b2a8-9466450e3b1b","resolution":{"observed_at":"2026-08-07T15:12:17.883888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:18.019509Z","title":"https://www.meta.ai, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.019509Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:b9bf202e69fd1658fcff1f98a628b70cc6a312b78f5fce8daf9e8fbe83712f75","observation_id":"27091ff0-102d-4124-8d26-6e80a6136dfe","resolution":{"observed_at":"2026-08-07T15:12:18.019509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:32.959458Z","title":"Tukey’s honestly significant difference (hsd) test","venue":null,"work_id":"9c4d829f-2843-45a5-8163-ad8ed643acba","year":2010},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.140041Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:a1db3c02777818b8ecfa07d6e4d1352b0d1fd177bf995870d48f0537eff62a5f","observation_id":"cf38449e-a6ba-49f6-b810-513208dd96c1","resolution":{"observed_at":"2026-08-07T15:12:33.024376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.05704","last_updated":"2021-09-14T06:27:36Z","snapshot_observed_at":"2026-08-05T13:34:18.702808Z","submitted_at":"2021-09-13T04:52:41Z","title":"Mitigating Language-Dependent Ethnic Bias in BERT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.05704","snapshot_observed_at":"2026-08-07T15:12:18.275983Z","title":"Mitigating language-dependent ethnic bias in bert","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.275983Z"},"links":{"cited_paper":"/paper/2109.05704","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:494082c73446ac2978ee8a02efe5bd339d83fc653ffd73b7f1c28493a2ce3e6b","observation_id":"5fb07169-7a57-4fd0-a9a8-ce1ea80e5927","resolution":{"observed_at":"2026-08-07T15:12:18.275983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:32.795003Z","title":"Amazon bedrock guardrails","venue":null,"work_id":"9377ae1b-2f0b-4f85-9fa8-882693743371","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.427567Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:c4bdb90d8246379d84bd438d5d45fd71d8d3b2ddc593545112275653f66dc72a","observation_id":"f4578404-f9f2-4b19-8eb3-86f2bbf2f202","resolution":{"observed_at":"2026-08-07T15:12:32.863742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12408","last_updated":"2025-04-16T18:17:19Z","snapshot_observed_at":"2026-08-08T02:22:50.046451Z","submitted_at":"2025-04-16T18:17:19Z","title":"A Human-AI Comparative Analysis of Prompt Sensitivity in LLM-Based Relevance Judgment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12408","snapshot_observed_at":"2026-08-07T15:12:18.548069Z","title":"A human-ai comparative analysis of prompt sensitivity in llm-based relevance judgment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.548069Z"},"links":{"cited_paper":"/paper/2504.12408","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:0d01300bf3ffea88fff97ad4b5971922463b91e69e9da281346ffe9ceb7402e3","observation_id":"11d2797a-da77-43e9-8bac-7afda67c3f9b","resolution":{"observed_at":"2026-08-07T15:12:18.548069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04667","last_updated":"2025-04-02T15:17:02Z","snapshot_observed_at":"2026-07-06T18:58:35.218405Z","submitted_at":"2024-08-06T16:43:35Z","title":"Non-Determinism of \"Deterministic\" LLM Settings","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04667","snapshot_observed_at":"2026-08-07T15:12:18.716951Z","title":"Llm stability: A detailed analysis with some surprises","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.716951Z"},"links":{"cited_paper":"/paper/2408.04667","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:5c6d7afc1c424dbd457246388e545359a764a6fdb8e9fd0b4fb2d5584ec310be","observation_id":"02e014cc-a2ce-4e43-808d-8de825d45fef","resolution":{"observed_at":"2026-08-07T15:12:18.716951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:18.815946Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.815946Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:654d6de1ab23bb1193f9ffece1fb9b9b76648dc9ac29ba513c0f2e5a9b391835","observation_id":"fe4888e9-46c0-4c98-bb3c-0c640548b716","resolution":{"observed_at":"2026-08-07T15:12:18.815946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.06413","last_updated":"2021-03-11T02:01:14Z","snapshot_observed_at":"2026-08-01T10:44:30.897763Z","submitted_at":"2021-03-11T02:01:14Z","title":"FairFil: Contrastive Neural Debiasing Method for Pretrained Text Encoders","version":1},"cited_work":{"arxiv_id":"2103.06413","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.06413","snapshot_observed_at":"2026-08-07T15:12:27.032930Z","title":"FairFil: Contrastive Neural Debiasing Method for Pretrained Text Encoders","venue":"cs.CL","work_id":"fa700d5b-561e-4ce2-ae7e-d8c673a38955","year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:18.982402Z"},"links":{"cited_paper":"/paper/2103.06413","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:353f291d5605866c0f6db8d916285615b4c3a20bf387ae38978466dd6633561a","observation_id":"bb3a2d54-1d8a-4e21-99cc-d06ef3418dd8","resolution":{"observed_at":"2026-08-07T15:12:27.164329Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20947","last_updated":"2025-06-15T21:44:25Z","snapshot_observed_at":"2026-07-06T18:23:23.565502Z","submitted_at":"2024-05-31T15:44:33Z","title":"OR-Bench: An Over-Refusal Benchmark for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20947","snapshot_observed_at":"2026-08-07T15:12:19.066466Z","title":"Or-bench: An over-refusal benchmark for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:19.066466Z"},"links":{"cited_paper":"/paper/2405.20947","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:51a1944f4f0cc8bfdc8c417124bf4d4b90cb92930eda7d635daabafc0e39100e","observation_id":"0758b737-4732-4884-9924-d4b18d25fad9","resolution":{"observed_at":"2026-08-07T15:12:19.066466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:19.173065Z","title":"Bert: Pre-training of deep bidi- rectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:19.173065Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:2e242acdc25a4da70162c1c68ee47bec7c190bbcba59437d1e7ca66b4a830fb0","observation_id":"c338b927-9b1c-4f4d-9ffc-207a5ac2d65c","resolution":{"observed_at":"2026-08-07T15:12:19.173065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:19.297539Z","title":"Bold: Dataset and metrics for measuring biases in open-ended language generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:19.297539Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:f1ab6e6a86025fd06dd073400d9f996608937fc9483eb197929e907718937287","observation_id":"6b5ca39a-ffbc-4f02-b6d7-08215b5c9787","resolution":{"observed_at":"2026-08-07T15:12:19.297539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11190","last_updated":"2024-02-17T04:48:55Z","snapshot_observed_at":"2026-08-03T04:47:47.300932Z","submitted_at":"2024-02-17T04:48:55Z","title":"Disclosure and Mitigation of Gender Bias in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11190","snapshot_observed_at":"2026-08-07T15:12:19.415481Z","title":"Disclosure and mitigation of gender bias in llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:19.415481Z"},"links":{"cited_paper":"/paper/2402.11190","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:7fb6db31ec1e63a875f4fda55fb9423daa096fa92d266a7382ab27756db5a446","observation_id":"8157e21b-4b7c-4a7f-a39b-ebe9562fb848","resolution":{"observed_at":"2026-08-07T15:12:19.415481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14739","last_updated":"2025-03-28T15:21:44Z","snapshot_observed_at":"2026-07-29T21:41:16.650188Z","submitted_at":"2025-02-20T17:05:58Z","title":"SuperGPQA: Scaling LLM Evaluation across 285 Graduate Disciplines","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14739","snapshot_observed_at":"2026-08-07T15:12:19.560729Z","title":"Supergpqa: Scaling llm evaluation across 285 graduate disciplines","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:19.560729Z"},"links":{"cited_paper":"/paper/2502.14739","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:d1f2bb23679432fc0607ed58b80f2377146515361b3cfca8c50251e523a7f003","observation_id":"5825adc7-a251-4d94-8bbf-d85ae8576f63","resolution":{"observed_at":"2026-08-07T15:12:19.560729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:32.658418Z","title":"Alpacafarm: A simulation framework for methods that learn from human feedback","venue":null,"work_id":"87f186ce-ffbe-40ac-a379-1a0a67dac0a1","year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:19.703634Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:e810ae04866c37df34cb05ecef36b9cc0b2f235c3fb6d8e9dc6a0a7ba91ca76f","observation_id":"82026c9e-a093-442e-a7e2-0a7c6444b669","resolution":{"observed_at":"2026-08-07T15:12:32.722693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:32.501479Z","title":"Meta ai refusing to answer questions related to politicians and par- ties ahead of elections in india, 2024","venue":null,"work_id":"b6980938-28c2-48ed-96aa-66b2f692c640","year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:19.856933Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:a360a35fd3f6fcf971ee3adedd85f230c7f15dd04915652bd21b05eb4b2b5991","observation_id":"0a9afb5e-8da9-4087-a629-60bb14512d12","resolution":{"observed_at":"2026-08-07T15:12:32.563582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-07T15:12:20.004814Z","title":"Toy models of superposition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.004814Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:18090c74c549e2b68efe3a0a7c9570340716ff43470a30525d5d8d0f564cf84f","observation_id":"b2492a96-992d-453f-8d21-e86786a60a30","resolution":{"observed_at":"2026-08-07T15:12:20.004814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18140","last_updated":"2023-11-29T23:03:04Z","snapshot_observed_at":"2026-08-01T16:04:11.365161Z","submitted_at":"2023-11-29T23:03:04Z","title":"ROBBIE: Robust Bias Evaluation of Large Generative Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18140","snapshot_observed_at":"2026-08-07T15:12:20.139639Z","title":"Robbie: Robust bias evaluation of large generative language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.139639Z"},"links":{"cited_paper":"/paper/2311.18140","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:fbf0217d0f0da79f59e021c48026072a83af9ec9156ab68e522d52c6963e738b","observation_id":"fc80d2f6-491b-453f-af53-37fcca23bb84","resolution":{"observed_at":"2026-08-07T15:12:20.139639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:20.291546Z","title":"Bias and fairness in large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.291546Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:e93e335c1d0fa24ab69aa88efdc876339e2846de2d6c9a14a8df369c8e905134","observation_id":"4bc9522b-1911-46b0-8868-8bf5a10ab785","resolution":{"observed_at":"2026-08-07T15:12:20.291546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:32.312533Z","title":"Pairwise multiple comparison procedures with unequal n’s and/or variances: a monte carlo study","venue":null,"work_id":"2a3e36e5-9fab-4a66-bfb2-f805bb38905c","year":1976},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.426690Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:22486b53be7f33d09648c803b8d2c94ef2cc80743960d3097dd222a4002f36cd","observation_id":"13c4e8a8-9369-4abf-9209-9364879cd4e4","resolution":{"observed_at":"2026-08-07T15:12:32.413947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11462","last_updated":"2020-09-25T20:22:26Z","snapshot_observed_at":"2026-07-06T09:58:19.547859Z","submitted_at":"2020-09-24T03:17:19Z","title":"RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11462","snapshot_observed_at":"2026-08-07T15:12:20.521002Z","title":"Realtoxicityprompts: Evaluating neural toxic degeneration in language models","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.521002Z"},"links":{"cited_paper":"/paper/2009.11462","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:f62a1ce0f8e0a6cbc64cb4bb76ec054d7cc4c1e8d4beed3ef04139767d10c261","observation_id":"cddec1c9-c2d5-4615-bddb-26582ad667b3","resolution":{"observed_at":"2026-08-07T15:12:20.521002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:32.102630Z","title":"Debiasing pre-trained language models via efficient fine-tuning","venue":null,"work_id":"c0d1ae4c-d4c6-48d3-91d2-82f753115ec6","year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.612760Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:a37e6ea1e27ef8456b90291199d464fa73d8c132fe988ce6710f6ec40a7aa10e","observation_id":"bd52ac49-2568-4496-83b5-0452e8d5603f","resolution":{"observed_at":"2026-08-07T15:12:32.190325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T15:12:20.754742Z","title":"A survey on llm-as-a-judge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.754742Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:f5c46c8ccdd1bd14a74edcc529f1c2670741603c575740f7b2c8ff60b44af74f","observation_id":"81337885-9f20-44bf-84ba-34c00a739afa","resolution":{"observed_at":"2026-08-07T15:12:20.754742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:31.916237Z","title":"We tried out deepseek","venue":null,"work_id":"9086d98c-5b17-4886-92ea-6b2d1214655c","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.827485Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:9d8bd4daf669084238cc971b93fd72a247c753b1ab0d2c44b156ad541e27cec2","observation_id":"bc5e5836-6e71-49db-a11c-68f0ec9b3020","resolution":{"observed_at":"2026-08-07T15:12:31.997050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:31.730499Z","title":"Auto-debias: Debiasing masked language models with automated biased prompts","venue":null,"work_id":"9766c6c7-8750-44b6-9caa-61360772ef8b","year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.874761Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:779df43b053acd526bac786d9580ad878880eec2ba7236d05069cebf5878a8c1","observation_id":"b9f7f6dd-7bd2-4dc5-bbcb-34757dbca244","resolution":{"observed_at":"2026-08-07T15:12:31.826061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-07-06T19:51:09.829522Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-07T15:12:20.912641Z","title":"Does prompt formatting have any impact on llm performance? arXiv preprint arXiv:2411.10541, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:20.912641Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:46684ff3e2318f9f124a929d3fc6f0eb2e2d62fee777104b628dc2867be6bd1b","observation_id":"5cf0360d-fe30-4af0-801e-713682834ef7","resolution":{"observed_at":"2026-08-07T15:12:20.912641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T15:12:21.025106Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.025106Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:72dcd6a64c39ce7ae02b06dd19328080d42f40526b1d5eca72dc79a1057de14d","observation_id":"4875d47e-8d33-40d7-a52a-bfac4fa55d63","resolution":{"observed_at":"2026-08-07T15:12:21.025106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03064","last_updated":"2020-10-08T17:58:35Z","snapshot_observed_at":"2026-07-06T08:35:28.740170Z","submitted_at":"2019-11-08T05:56:01Z","title":"Reducing Sentiment Bias in Language Models via Counterfactual Evaluation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.03064","snapshot_observed_at":"2026-08-07T15:12:21.086207Z","title":"Reducing sentiment bias in language models via counterfactual evaluation","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.086207Z"},"links":{"cited_paper":"/paper/1911.03064","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:c5dcfddfe90a8ba082f9877f20698156133915c5dd08ac5668a75317c75bf480","observation_id":"9288de9f-697d-41e5-8006-36910969edb9","resolution":{"observed_at":"2026-08-07T15:12:21.086207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:31.464374Z","title":"Perspective api, 2025","venue":null,"work_id":"cfb22011-e0b3-4f8d-bd02-ff8f1e7cbbce","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.163584Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:bbce2fbc462af111334f9a8699eecca61343fedd59f40a4dd3f4330812d24d3f","observation_id":"94768ba5-bedc-4d62-9e37-9b389fae0686","resolution":{"observed_at":"2026-08-07T15:12:31.572271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.09523","last_updated":"2021-01-23T15:28:48Z","snapshot_observed_at":"2026-07-06T10:34:56.873087Z","submitted_at":"2021-01-23T15:28:48Z","title":"Debiasing Pre-trained Contextualised Embeddings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.09523","snapshot_observed_at":"2026-08-07T15:12:21.217936Z","title":"Debiasing pre-trained contextualised embeddings","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.217936Z"},"links":{"cited_paper":"/paper/2101.09523","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:40abccf420581850db0cbf6685e7911ecad6d19925023bd4a0e49320fddedccf","observation_id":"4c37d7f6-31c5-40eb-88bd-3596d7a7721b","resolution":{"observed_at":"2026-08-07T15:12:21.217936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:21.293155Z","title":"Pretraining language models with human preferences","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.293155Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:875b3c4aaa40a076b2f7ab002288cc982c7c278f37673e71fd29a6cc16a17433","observation_id":"f776040b-4aa1-490c-98c5-ba51bdd90fc0","resolution":{"observed_at":"2026-08-07T15:12:21.293155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07337","last_updated":"2019-06-18T01:58:56Z","snapshot_observed_at":"2026-07-06T08:01:01.134587Z","submitted_at":"2019-06-18T01:58:56Z","title":"Measuring Bias in Contextualized Word Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.07337","snapshot_observed_at":"2026-08-07T15:12:21.340647Z","title":"Measuring bias in contextual- ized word representations","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.340647Z"},"links":{"cited_paper":"/paper/1906.07337","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:c2bf87e5d468ca9b214b73aa6e6291f3e1b8b4b634734ebf333e43cbb8ab4214","observation_id":"04241856-2d8a-48a5-90dc-7c056fc46297","resolution":{"observed_at":"2026-08-07T15:12:21.340647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:31.220381Z","title":"Equivalence tests: A practical primer for t tests, correlations, and meta-analyses","venue":null,"work_id":"97de0c8e-df27-40d1-9257-66616200719c","year":2017},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.373901Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:bc65c7f19bc14f6b5c3b8dd21cfa9e71755cabb58373ae9dab3268f378f9be0b","observation_id":"13f4ea0b-56d7-465c-8718-3f306199ce9b","resolution":{"observed_at":"2026-08-07T15:12:31.339605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00585","last_updated":"2026-04-22T07:00:12Z","snapshot_observed_at":"2026-07-06T19:43:33.476795Z","submitted_at":"2024-11-01T13:47:00Z","title":"Fairness Testing of Large Language Models in Role-Playing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00585","snapshot_observed_at":"2026-08-07T15:12:21.650019Z","title":"Benchmarking bias in large language models during role-playing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.650019Z"},"links":{"cited_paper":"/paper/2411.00585","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:189be7c04ae03e4b9818805b5ba8c17862994f4bb61aac29af98aabdae3ddf67","observation_id":"900fb795-066d-4dff-ae43-98f629135183","resolution":{"observed_at":"2026-08-07T15:12:21.650019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:21.727008Z","title":"Alpacaeval: An automatic evaluator of instruction-following models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.727008Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:d6dc260e4280f25e784483b6e206169007c709469267ce33dafa9963e3de1e93","observation_id":"d05f91ee-fda1-4647-b3ad-ebb11077e1e8","resolution":{"observed_at":"2026-08-07T15:12:21.727008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08100","last_updated":"2020-07-16T04:22:30Z","snapshot_observed_at":"2026-08-04T04:06:02.660083Z","submitted_at":"2020-07-16T04:22:30Z","title":"Towards Debiasing Sentence Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.08100","snapshot_observed_at":"2026-08-07T15:12:21.833828Z","title":"Towards debiasing sentence representations","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.833828Z"},"links":{"cited_paper":"/paper/2007.08100","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:8f9e57549f73b37f1b477c963584808014ad29ffbfffb5c4b41f7515247c19ff","observation_id":"ecde6a30-1e10-4d50-aea4-2ca2f4ab2083","resolution":{"observed_at":"2026-08-07T15:12:21.833828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:30.962855Z","title":"Towards understanding and mitigating social biases in language models","venue":null,"work_id":"3f76a72f-43e3-498b-a5c2-3aa7fe90dfc7","year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:21.919579Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:ef51b15ce0f55dc9974705b548e3cf2b58cd58aaf796b9854acfe3920211dc44","observation_id":"94d18f79-d22a-4a1d-8332-1afc7a36329e","resolution":{"observed_at":"2026-08-07T15:12:31.100134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-01T19:14:56.803459Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-07T15:12:22.022328Z","title":"Holistic evaluation of language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.022328Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:fceca38c7c0c2aef7f7e85a2cd4b0272594635067d089eeb6f1b740284a6ef0e","observation_id":"9e817d53-75a9-4742-972f-1035cb756a88","resolution":{"observed_at":"2026-08-07T15:12:22.022328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14896","last_updated":"2024-12-10T07:43:50Z","snapshot_observed_at":"2026-07-06T17:48:45.803098Z","submitted_at":"2024-03-22T00:59:48Z","title":"Investigating Bias in LLM-Based Bias Detection: Disparities between LLMs and Human Perception","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14896","snapshot_observed_at":"2026-08-07T15:12:22.173007Z","title":"Investigating Bias in LLM-Based Bias Detection: Disparities between LLMs and Human Perception, December 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.173007Z"},"links":{"cited_paper":"/paper/2403.14896","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:5c2d31907ad6b861bcdebbec414a4d81a483b3c9b3d400abe51e44855d67c71e","observation_id":"5be1b9cd-4210-480c-846b-3d16adc3b2f5","resolution":{"observed_at":"2026-08-07T15:12:22.173007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10486","last_updated":"2020-10-31T19:04:07Z","snapshot_observed_at":"2026-07-06T08:31:36.604379Z","submitted_at":"2019-10-16T22:17:02Z","title":"Does Gender Matter? Towards Fairness in Dialogue Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10486","snapshot_observed_at":"2026-08-07T15:12:22.311528Z","title":"Does gender matter? towards fairness in dialogue systems","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.311528Z"},"links":{"cited_paper":"/paper/1910.10486","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:f9a895ff8264be29e54f5fbb5808c770e7d3bc015229e8a9a205f11f9603e948","observation_id":"bed8add1-4382-4d3a-a30b-00692b898d15","resolution":{"observed_at":"2026-08-07T15:12:22.311528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:30.716292Z","title":"Lmarena: Open platform for crowdsourced ai benchmarking","venue":null,"work_id":"02a1def6-6c09-476b-891a-138f33f45182","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.483302Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:f887cb2d5fa094f6dc54472c277a8dbaa1906bad7d61266d92cc11e12f429cea","observation_id":"d5d6003c-7c16-44c6-85d0-3af142aefd78","resolution":{"observed_at":"2026-08-07T15:12:30.817269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:30.467038Z","title":"Azure openai service content filtering","venue":null,"work_id":"b0263f8b-5c6e-4069-a5c3-ea9f056544d2","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.598191Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:80b1a1c508ed58093a95fe567497bfe5527cfc3bb79839b5cba4e74cd2e69610","observation_id":"7f818f25-51e8-4eb6-9bee-290dcef3de71","resolution":{"observed_at":"2026-08-07T15:12:30.573600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-08-07T15:12:22.712392Z","title":"Crows-pairs: A challenge dataset for measuring social biases in masked language models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.712392Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:edc4654b70c92c016451fe2e3373ff9544ef3cb69e4dcedd99c5a6bf5423da60","observation_id":"debc0755-9045-45b1-9b60-0bd2280fead5","resolution":{"observed_at":"2026-08-07T15:12:22.712392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.08877","last_updated":"2021-12-14T06:19:33Z","snapshot_observed_at":"2026-08-06T08:28:54.662531Z","submitted_at":"2021-08-19T18:58:02Z","title":"Sentence-T5: Scalable Sentence Encoders from Pre-trained Text-to-Text Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.08877","snapshot_observed_at":"2026-08-07T15:12:22.808661Z","title":"Sentence-t5: Scalable sentence encoders from pre-trained text-to-text models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.808661Z"},"links":{"cited_paper":"/paper/2108.08877","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:1fcc322c23b6f4f624d79903e07cdaf77eff16ec382a35971c66e1a968b736df","observation_id":"82e35708-b7a9-4509-960f-b2fcb2468cf6","resolution":{"observed_at":"2026-08-07T15:12:22.808661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:30.220653Z","title":"Honest: Measuring hurtful sentence completion in language models","venue":null,"work_id":"c67f3c52-ec30-4ffc-b338-332ff3012fb0","year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.902161Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:4031f49cf49ba5d04fd41ca024b9ce2a8c21366cc250430595f4b70debeb3432","observation_id":"bc9135a4-6626-4692-8217-3ef9f92ed405","resolution":{"observed_at":"2026-08-07T15:12:30.369802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14769","last_updated":"2023-12-29T11:07:09Z","snapshot_observed_at":"2026-08-08T02:07:31.460775Z","submitted_at":"2023-12-22T15:38:13Z","title":"Large Language Model (LLM) Bias Index -- LLMBI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14769","snapshot_observed_at":"2026-08-07T15:12:22.978844Z","title":"Large Language Model (LLM) Bias Index – LLMBI, December 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.978844Z"},"links":{"cited_paper":"/paper/2312.14769","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:d721f410b47eb6b8397618d9d0e7337497019e8c626a2510e51fc79c92f3aed3","observation_id":"7f840faa-bef0-42ee-b0dc-83a1ca6f1fa7","resolution":{"observed_at":"2026-08-07T15:12:22.978844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T15:12:23.078776Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.078776Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:b18f066da6b2e2a032a7b0761fae7f6390997d91c664e2601024ce9937d6e24b","observation_id":"db77cd14-10cc-4dad-942e-f3e128a84168","resolution":{"observed_at":"2026-08-07T15:12:23.078776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:29.994170Z","title":"The perils and promises of fact-checking with large language models","venue":null,"work_id":"c5612d10-15c1-4186-93d3-a4095e9f8e65","year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.154522Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:e1a1b7ecf4f521951a3ea9437520f1a94f9ffc7637ec6a4820c0ca7284843ad7","observation_id":"7b5cda11-1dbf-44bf-adf9-4569df9bbcfc","resolution":{"observed_at":"2026-08-07T15:12:30.102080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11290","last_updated":"2024-06-28T16:35:15Z","snapshot_observed_at":"2026-07-06T18:16:11.502190Z","submitted_at":"2024-05-18T13:31:12Z","title":"MBIAS: Mitigating Bias in Large Language Models While Retaining Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11290","snapshot_observed_at":"2026-08-07T15:12:23.243382Z","title":"Mbias: Mitigating bias in large language models while retaining context","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.243382Z"},"links":{"cited_paper":"/paper/2405.11290","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:3770ab1973bb1b6a987cda222bddd1208063b656be3a8170ffef5b6ae813d70b","observation_id":"4aa33908-6d17-4353-a76f-5c31de903cc5","resolution":{"observed_at":"2026-08-07T15:12:23.243382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10501","last_updated":"2023-10-16T15:20:30Z","snapshot_observed_at":"2026-08-07T08:20:45.612923Z","submitted_at":"2023-10-16T15:20:30Z","title":"NeMo Guardrails: A Toolkit for Controllable and Safe LLM Applications with Programmable Rails","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10501","snapshot_observed_at":"2026-08-07T15:12:23.329400Z","title":"Nemo guardrails: A toolkit for controllable and safe llm applications with programmable rails","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.329400Z"},"links":{"cited_paper":"/paper/2310.10501","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:4d1e359d1b1914adaf8638f79d6b61d3f26f9a5739f66e6e26524e6c78b2c158","observation_id":"717f6f6f-6ed1-4ab2-8aac-de77b9e10e61","resolution":{"observed_at":"2026-08-07T15:12:23.329400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-07-06T08:17:05.681370Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-07T15:12:23.428995Z","title":"Sentence-bert: Sentence embeddings using siamese bert-networks","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.428995Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:6fd559ae74533760b7762eefbe1278f9d8d4e085be40a94ed63aa365bffa1a80","observation_id":"023e3dd2-a012-45f6-8ce4-d8c286ca2e5b","resolution":{"observed_at":"2026-08-07T15:12:23.428995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:29.761205Z","title":"Does deepseek censor its answers? we asked 5 questions on sensitive china top- ics","venue":null,"work_id":"6596dbed-bbd5-43a1-9462-83c0bf748864","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.541843Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:ace3005c2f5b39870262ae2f4ac43a69e61994c877d6bf357e0993b829d54f39","observation_id":"d7384e92-8db2-4a4b-82cd-52ed3d1c5261","resolution":{"observed_at":"2026-08-07T15:12:29.864986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:23.660114Z","title":"Introduction to probability models","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.660114Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:5da8ce2e9ce0e7cf54849bfe58dcb53f99416e8c8ef3c29fe6ec90640f675066","observation_id":"5dad7343-2525-4cc9-a388-3578f07946de","resolution":{"observed_at":"2026-08-07T15:12:23.660114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:29.532517Z","title":"Self-diagnosis and self-debiasing: A proposal for reducing corpus-based bias in nlp","venue":null,"work_id":"0b28365b-f2f9-4a5e-9cde-d8ba1646413f","year":2021},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.743605Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:44223b34776e60a024853dd32657c627fe0ee8f91500915905f6c2b89209af59","observation_id":"c786a44b-f57f-4d3f-9d2d-5d2398be8f55","resolution":{"observed_at":"2026-08-07T15:12:29.641418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:29.377420Z","title":"A comparison of the two one-sided tests procedure and the power approach for assessing the equivalence of average bioavailability","venue":null,"work_id":"4e64c8af-e3c9-45ae-937c-fef967d07ff4","year":1987},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:23.964865Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:e6fc053f244d8df8ed88547b478f399614f44a1a505ec8ddfdd2ac9f0a7f1e21","observation_id":"237f47cf-82c3-43bb-9f8b-520b225f8c36","resolution":{"observed_at":"2026-08-07T15:12:29.430369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15025","last_updated":"2023-09-26T15:49:23Z","snapshot_observed_at":"2026-07-06T16:23:53.247204Z","submitted_at":"2023-09-26T15:49:23Z","title":"Large Language Model Alignment: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15025","snapshot_observed_at":"2026-08-07T15:12:24.027242Z","title":"Large language model alignment: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.027242Z"},"links":{"cited_paper":"/paper/2309.15025","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:39cf748fdb9a6305ddda9ab25a1c725bae43cf0cd2e6b1a12f092128f9ed9d6e","observation_id":"5e59c711-700f-44cf-b5de-bb0b683911ad","resolution":{"observed_at":"2026-08-07T15:12:24.027242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09150","last_updated":"2023-02-15T02:24:43Z","snapshot_observed_at":"2026-07-06T14:06:44.908737Z","submitted_at":"2022-10-17T14:52:39Z","title":"Prompting GPT-3 To Be Reliable","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09150","snapshot_observed_at":"2026-08-07T15:12:24.224762Z","title":"Prompting gpt-3 to be reliable","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.224762Z"},"links":{"cited_paper":"/paper/2210.09150","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:e0b732f5a72844f0e80e18136c16ab01384b60ddb2e479a74a1dd731a2825042","observation_id":"99c86017-6745-4a4d-935a-2c35e05ab2d2","resolution":{"observed_at":"2026-08-07T15:12:24.224762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10457","last_updated":"2024-07-15T06:12:17Z","snapshot_observed_at":"2026-07-06T18:46:18.540571Z","submitted_at":"2024-07-15T06:12:17Z","title":"The Good, The Bad, and The Greedy: Evaluation of LLMs Should Not Ignore Non-Determinism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10457","snapshot_observed_at":"2026-08-07T15:12:24.340787Z","title":"The good, the bad, and the greedy: Evaluation of llms should not ignore non-determinism","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.340787Z"},"links":{"cited_paper":"/paper/2407.10457","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:1f363af00f3860fd5baabc6a7f3eb7e772d3de21a7b918d744195291cfd3788a","observation_id":"3ea5021e-aa06-4c4f-a1cb-bce3c7a11016","resolution":{"observed_at":"2026-08-07T15:12:24.340787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:29.197821Z","title":"Analysis of variance (anova).Chemometrics and intelligent laboratory systems, 6(4):259–272, 1989","venue":null,"work_id":"f3d8eda8-0b0d-4bc8-9609-7acf461555b4","year":1989},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.408924Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:23926c6d2c9ef1f4b5628eccaabc81cdf4647d8046bade16aeda1d3d4ef5bdec","observation_id":"8d7614bc-8ed8-49dc-a1c9-73f71e6fe84a","resolution":{"observed_at":"2026-08-07T15:12:29.270644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09741","last_updated":"2023-05-30T15:22:50Z","snapshot_observed_at":"2026-08-04T08:37:37.119739Z","submitted_at":"2022-12-19T18:57:05Z","title":"One Embedder, Any Task: Instruction-Finetuned Text Embeddings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09741","snapshot_observed_at":"2026-08-07T15:12:24.472276Z","title":"One embedder, any task: Instruction-finetuned text embeddings","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.472276Z"},"links":{"cited_paper":"/paper/2212.09741","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:e8db421bafe6681ee07e80d447475dbf0ca69c6042568a82239f0edd4b01043f","observation_id":"118dff2d-0753-4dd6-9bc8-c24c37b20be7","resolution":{"observed_at":"2026-08-07T15:12:24.472276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:28.930863Z","title":"Grok 3 appears to have briefly censored unflattering mentions of trump and musk, 2025","venue":null,"work_id":"47235d99-970b-4d23-ae35-31b63f3631e2","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.566817Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:38e6f6dbeecc80bd0982709028bceeef619c18a5ce8e59ccd7740089f1443e39","observation_id":"d94475bd-d37f-40e5-b28d-2b83a782add4","resolution":{"observed_at":"2026-08-07T15:12:29.089474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.14552","last_updated":"2022-10-26T08:13:58Z","snapshot_observed_at":"2026-08-01T20:28:21.399309Z","submitted_at":"2022-10-26T08:13:58Z","title":"A Robust Bias Mitigation Procedure Based on the Stereotype Content Model","version":1},"cited_work":{"arxiv_id":"2210.14552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.14552","snapshot_observed_at":"2026-08-07T15:12:26.586151Z","title":"A Robust Bias Mitigation Procedure Based on the Stereotype Content Model","venue":"cs.CL","work_id":"bf3f104d-b513-4d63-8620-00a65a2559ee","year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.658029Z"},"links":{"cited_paper":"/paper/2210.14552","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:109f081c741efca0c26082e2de0a47d8c80b7eaeadd4ca12e41fb59303420b56","observation_id":"2554893e-4bef-45d0-a450-5f78479ec2bc","resolution":{"observed_at":"2026-08-07T15:12:26.644599Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:28.735925Z","title":"Llm leaderboard, 2025","venue":null,"work_id":"b48df884-c61a-4e6c-8388-42a00f4a1066","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.738891Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:4a8def2f108bc0b00baa05711c8b4a0be05a0b5b658357ed6acb618e0ae71870","observation_id":"ea0bf318-8eca-4227-be09-d081ae39eca8","resolution":{"observed_at":"2026-08-07T15:12:28.824739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:28.492206Z","title":"The dark side of generative artificial intelligence: A critical analysis of controversies and risks of chatgpt","venue":null,"work_id":"9a9ef5ee-ceab-4a67-898f-1092ba0f233a","year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.829066Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:92f20a1981d0d4d51d5ce4abf58f117cf01a4bdeede53e9fa9cfb722e5b268dd","observation_id":"0fed6980-7565-461d-85dd-9683beba6d21","resolution":{"observed_at":"2026-08-07T15:12:28.629921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17926","last_updated":"2023-08-30T13:22:35Z","snapshot_observed_at":"2026-08-03T19:35:11.838629Z","submitted_at":"2023-05-29T07:41:03Z","title":"Large Language Models are not Fair Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17926","snapshot_observed_at":"2026-08-07T15:12:24.922647Z","title":"Large language models are not fair evaluators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.922647Z"},"links":{"cited_paper":"/paper/2305.17926","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:95bfaccbad5b9faba50568ed5d63af16aab7fb36f644de5ee63fd3924b430975","observation_id":"9f96eb18-a34c-4bf0-a191-435305c35cf0","resolution":{"observed_at":"2026-08-07T15:12:24.922647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10560","last_updated":"2023-05-25T23:50:07Z","snapshot_observed_at":"2026-07-06T14:33:11.945106Z","submitted_at":"2022-12-20T18:59:19Z","title":"Self-Instruct: Aligning Language Models with Self-Generated Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10560","snapshot_observed_at":"2026-08-07T15:12:24.998012Z","title":"Self-instruct: Aligning language models with self-generated instructions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:24.998012Z"},"links":{"cited_paper":"/paper/2212.10560","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:411fd9e1bebac5ed164d12346e942ca45a8b55c1f5c050f194b1ac88ffd239e5","observation_id":"d4827d86-f6f6-4b39-b673-e5803bfd6fe1","resolution":{"observed_at":"2026-08-07T15:12:24.998012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:25.092944Z","title":"Mmlu-pro: A more robust and challenging multi-task language understanding benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.092944Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:df9d39161d86383232b161f1b9a8e9593aebe7fd61b6f78967b2f456bae9f057","observation_id":"4c3efecd-3656-42c7-801a-bbec0a5ce01b","resolution":{"observed_at":"2026-08-07T15:12:25.092944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:25.172063Z","title":"All of statistics: a concise course in statistical inference","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.172063Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:f2aea8efb1f7916af73f1710ecc0fa84da86b99ccf4f95f9af64137b00fd8993","observation_id":"d37038b2-8922-475e-98fc-2cf000c107c7","resolution":{"observed_at":"2026-08-07T15:12:25.172063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.06032","last_updated":"2021-03-02T21:04:26Z","snapshot_observed_at":"2026-07-06T10:03:46.733926Z","submitted_at":"2020-10-12T21:15:29Z","title":"Measuring and Reducing Gendered Correlations in Pre-trained Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.06032","snapshot_observed_at":"2026-08-07T15:12:25.231885Z","title":"Measuring and reducing gendered correlations in pre-trained models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.231885Z"},"links":{"cited_paper":"/paper/2010.06032","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:0bf7e72840d83da52626a60b0d49ee165987799da208df02d1cb5b0a5e8c9c12","observation_id":"91b9fee3-05ff-4342-92ce-8b9e21dd9b7b","resolution":{"observed_at":"2026-08-07T15:12:25.231885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:25.322067Z","title":"The generalization of ‘student’s’problem when several different population varlances are involved","venue":null,"work_id":null,"year":1947},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.322067Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:ac80dad0a0d82c3fef2a07ff8730eea876dfaab3566ca373fe7068c249f28c4b","observation_id":"a60db2fb-3c48-4f80-9cb9-f55dad0982d9","resolution":{"observed_at":"2026-08-07T15:12:25.322067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:28.258205Z","title":"Livebench: A challenging, contamination-free LLM benchmark","venue":null,"work_id":"1bcfc5cc-a3e7-4c43-9afb-2e9ac0a901e0","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.414011Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:97a17e109677600afdcd9294e738e88d0e583ebfb56881521c2abea85772611f","observation_id":"fdbc3afe-5b05-4fca-8ae5-f5e313faf5b8","resolution":{"observed_at":"2026-08-07T15:12:28.344544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:28.050075Z","title":"This powerful new chatbot works great—unless you ask about china, 2025","venue":null,"work_id":"fd588543-8e78-4623-a1c0-675565247373","year":2025},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.526743Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:8ab675a104748e1938b24f42c55c3a114e638d2354dd49ddae40777c5e79f24a","observation_id":"8ea27ce6-d086-4b6b-a7ff-3aa3a6784b2c","resolution":{"observed_at":"2026-08-07T15:12:28.133989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:27.877951Z","title":"Compensatory debiasing for gender imbalances in language models","venue":null,"work_id":"ae08b339-11ce-4cd8-88b3-dfbd054c75a6","year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.608617Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:1c1bf03a99ecb8cb53c5a6f1fdfea2d151770bda73ec81072e1feadde209d95f","observation_id":"8a853731-12f4-440a-ad5f-9c07a3867568","resolution":{"observed_at":"2026-08-07T15:12:27.962499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05093","last_updated":"2025-05-12T01:30:34Z","snapshot_observed_at":"2026-07-06T18:58:52.488614Z","submitted_at":"2024-08-09T14:34:32Z","title":"Order Matters in Hallucination: Reasoning Order as Benchmark and Reflexive Prompting for Large-Language-Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05093","snapshot_observed_at":"2026-08-07T15:12:25.691449Z","title":"Order matters in hallucination: Reasoning order as benchmark and reflexive prompting for large-language-models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.691449Z"},"links":{"cited_paper":"/paper/2408.05093","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:76c33491b8aacdc6b1e9af067a90822dea6e8a9b98d9b7a0156d099087441099","observation_id":"febd100a-0219-41c8-9fd7-2d4b3b64b0cb","resolution":{"observed_at":"2026-08-07T15:12:25.691449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:27.719313Z","title":"Large language model as attributed training data generator: A tale of diversity and bias","venue":null,"work_id":"2587e676-6f78-4543-bf71-a052898f85cc","year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.797224Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:80e36160903e2e2587feefc5c2bdce4ceb618da6e373fd20f47e3d0dfe4a4226","observation_id":"c813e29d-1692-4e8f-b78b-f080f31fb17d","resolution":{"observed_at":"2026-08-07T15:12:27.777884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01862","last_updated":"2023-08-03T16:38:34Z","snapshot_observed_at":"2026-08-07T15:42:39.404449Z","submitted_at":"2023-08-03T16:38:34Z","title":"Wider and Deeper LLM Networks are Fairer LLM Evaluators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01862","snapshot_observed_at":"2026-08-07T15:12:25.897572Z","title":"Wider and deeper llm networks are fairer llm evaluators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.897572Z"},"links":{"cited_paper":"/paper/2308.01862","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:cdce23d4f7b34a373a4012748faa5ae4a7e78a194b41d7ba5ebcbf7fb681d042","observation_id":"b497a7b1-6cbe-42cb-8f8f-6b4ef4ab3a57","resolution":{"observed_at":"2026-08-07T15:12:25.897572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:25.991115Z","title":"Explainability for large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:25.991115Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:19830165d113d94d5a476465aa2f31108821799c89bf6caf604516efeb0c9bfe","observation_id":"a85f9f47-6d90-443d-ada6-a810ed66b41e","resolution":{"observed_at":"2026-08-07T15:12:25.991115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06315","last_updated":"2023-12-11T12:02:14Z","snapshot_observed_at":"2026-08-05T11:24:30.792700Z","submitted_at":"2023-12-11T12:02:14Z","title":"GPTBIAS: A Comprehensive Framework for Evaluating Bias in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06315","snapshot_observed_at":"2026-08-07T15:12:26.108646Z","title":"Gptbias: A comprehensive framework for evaluating bias in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:26.108646Z"},"links":{"cited_paper":"/paper/2312.06315","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:dfd142ce97c7740f20ed6b505631783f10e2e1120e77a3d64e0dcf5b38b0e220","observation_id":"0186f663-106e-4d56-b52e-bc8829b8046b","resolution":{"observed_at":"2026-08-07T15:12:26.108646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:26.214959Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:26.214959Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:10f39b1385f5175e386b943e45d9a5792295773ca50005a340fd64fe61a68912","observation_id":"36bb37d0-4df9-483f-8d44-fdea6d64eb38","resolution":{"observed_at":"2026-08-07T15:12:26.214959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:26.258317Z","title":"Lima: Less is more for alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:26.258317Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:19865c55a843d2f2dff594457d8efba3bd494a889b823656988e4928b77d2fe9","observation_id":"3483dc30-69ef-424c-8e25-217f447deeca","resolution":{"observed_at":"2026-08-07T15:12:26.258317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:27.528778Z","title":"{question}","venue":null,"work_id":"4328a345-91e5-45c4-b2b9-6f22a6a60c64","year":2022},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:26.342749Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:b45c086c292135e0bfaac60b463c2819d57bd466fe67152c5310981ae6e616e3","observation_id":"13ab7a7b-870e-4cd0-a527-687eedc76b63","resolution":{"observed_at":"2026-08-07T15:12:27.596932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:12:27.337896Z","title":"A.3 Bias Criteria Table Score Description 1 Fully neutral and factual","venue":null,"work_id":"7d80e5d6-7eb3-4c2a-b032-19270c8a397c","year":null},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:26.426274Z"},"links":{"citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:88b0f21ed7f36539bdde51a4b68a206ce240f6a93550d7b2c0569f334306fdc8","observation_id":"5ba7887e-9682-456e-966d-43e54c02743d","resolution":{"observed_at":"2026-08-07T15:12:27.434147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs"},"reference_resolution":{"displayed":84,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":54,"verified_exact":2,"verified_fuzzy":28},"total_outbound_references":84},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 84 of 84 outbound references and 0 inbound Pith citation observations for arXiv:2505.17131."}