{"as_of":"2026-08-10T10:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8258aa394f39c50b726cbf172abcd0c6f8442460c698cd543b93534db04d6404","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T23:35:42.784802Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T17:38:44.469211Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":"2010.00133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-07-03T17:38:44.469211Z","title":"arXiv preprint arXiv:2010.00133 , year=","venue":null,"work_id":"98abd3ca-3f3e-4a42-8d54-3b7d50fe011a","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:671aa4a60b57e47f1fe3231a4456dc6926340d7323bb939377bd899bd1b54a60","observation_id":"9a077b82-d57f-43c1-ac94-05b8d5ebfae8","resolution":{"observed_at":"2026-05-16T19:55:11.531159Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":"2010.00133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-07-03T17:38:44.469211Z","title":"arXiv preprint arXiv:2010.00133 , year=","venue":null,"work_id":"98abd3ca-3f3e-4a42-8d54-3b7d50fe011a","year":2020},"citing_paper":{"arxiv_id":"2112.04359","last_updated":"2021-12-08T16:09:48Z","snapshot_observed_at":"2026-08-09T15:17:43.394064Z","submitted_at":"2021-12-08T16:09:48Z","title":"Ethical and social risks of harm from Language Models","version":1},"reference_index":201,"source":"arxiv_source","source_observed_at":"2026-05-11T18:24:28.835688Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2112.04359"},"observation_digest":"sha256:d3adad80517b1e9448a8abd6bb374802f483f11d902b9a31255f1faf588bbed3","observation_id":"38d5b2cf-e3c2-4d57-b0fd-c6b791de08f3","resolution":{"observed_at":"2026-05-11T18:24:30.394343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":"2010.00133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-07-03T17:38:44.469211Z","title":"arXiv preprint arXiv:2010.00133 , year=","venue":null,"work_id":"98abd3ca-3f3e-4a42-8d54-3b7d50fe011a","year":2020},"citing_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"reference_index":218,"source":"arxiv_source","source_observed_at":"2026-05-10T20:53:16.720145Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2205.01068"},"observation_digest":"sha256:0176ef31b294a5d0f8e4c333708a07ba4b3b20940f57c43452831ef18a706ac2","observation_id":"17ce16be-f6a0-4e89-a2cf-9c92e3b0b68e","resolution":{"observed_at":"2026-05-10T20:53:17.745943Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":"2010.00133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-07-03T17:38:44.469211Z","title":"arXiv preprint arXiv:2010.00133 , year=","venue":null,"work_id":"98abd3ca-3f3e-4a42-8d54-3b7d50fe011a","year":2020},"citing_paper":{"arxiv_id":"2305.06161","last_updated":"2023-12-13T14:44:10Z","snapshot_observed_at":"2026-07-06T15:25:35.930688Z","submitted_at":"2023-05-09T08:16:42Z","title":"StarCoder: may the source be with you!","version":2},"reference_index":273,"source":"arxiv_source","source_observed_at":"2026-05-10T23:32:59.517389Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2305.06161"},"observation_digest":"sha256:9b051a4dfa184ab49808c9b38d9116d9d920f66af65b54812529f9a134bb7f6e","observation_id":"623afe96-ab53-475a-91b2-a99c22756bc2","resolution":{"observed_at":"2026-05-10T23:33:01.075879Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":"2010.00133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-07-03T17:38:44.469211Z","title":"arXiv preprint arXiv:2010.00133 , year=","venue":null,"work_id":"98abd3ca-3f3e-4a42-8d54-3b7d50fe011a","year":2020},"citing_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-08-07T08:02:34.857823Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-13T12:01:42.290502Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2401.10020"},"observation_digest":"sha256:47763063cbc92f0dc8df0bcff8337e012f92ea19bb057d8e0b3651f789d53784","observation_id":"a93c8510-cb55-44e1-8637-8e8266c155c7","resolution":{"observed_at":"2026-05-13T12:01:42.380838Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-08-07T23:35:42.784802Z","title":"arXiv preprint arXiv:2010.00133 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.09670","last_updated":"2025-02-12T22:55:43Z","snapshot_observed_at":"2026-08-09T08:58:06.881734Z","submitted_at":"2025-02-12T22:55:43Z","title":"The Science of Evaluating Foundation Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T23:35:42.784802Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2502.09670"},"observation_digest":"sha256:9ce0a18a4351d63dce8460bd658f729c87609f8970d88dc144531df186a106f3","observation_id":"9650fbdc-45db-4b52-91b3-d6f33ab9d339","resolution":{"observed_at":"2026-08-07T23:35:42.784802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-08-07T15:12:22.712392Z","title":"Crows-pairs: A challenge dataset for measuring social biases in masked language models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.17131","last_updated":"2025-05-22T01:59:54Z","snapshot_observed_at":"2026-08-07T23:47:01.265288Z","submitted_at":"2025-05-22T01:59:54Z","title":"Relative Bias: A Comparative Framework for Quantifying Bias in LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:22.712392Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2505.17131"},"observation_digest":"sha256:edc4654b70c92c016451fe2e3373ff9544ef3cb69e4dcedd99c5a6bf5423da60","observation_id":"debc0755-9045-45b1-9b60-0bd2280fead5","resolution":{"observed_at":"2026-08-07T15:12:22.712392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-08-07T11:39:52.400219Z","title":"Crows-pairs: A challenge dataset for measuring social biases in masked language models.arXiv preprint arXiv:2010.00133, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.01709","last_updated":"2025-06-02T14:15:37Z","snapshot_observed_at":"2026-08-07T23:46:26.773137Z","submitted_at":"2025-06-02T14:15:37Z","title":"Fairness Dynamics During Training","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:39:52.400219Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2506.01709"},"observation_digest":"sha256:e324541ab4989b0a88cd80a1eb3018a65ee502fcb60f6e318cc0beb1bde205f2","observation_id":"d944497f-7a5c-4241-b556-6f5bc7a114c2","resolution":{"observed_at":"2026-08-07T11:39:52.400219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-08-07T11:13:02.006492Z","title":"Crows-pairs: A challenge dataset for measuring social biases in masked language models,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.03426","last_updated":"2025-06-03T22:12:28Z","snapshot_observed_at":"2026-08-10T03:12:54.545108Z","submitted_at":"2025-06-03T22:12:28Z","title":"Adaptive Task Vectors for Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:13:02.006492Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2506.03426"},"observation_digest":"sha256:7b59bbff99e9cf10e072049c93d8ca4caa43cfddb30ce7e0eaceda8afa484fff","observation_id":"805eee57-73d7-44a2-873d-e2ec3c41b2cd","resolution":{"observed_at":"2026-08-07T11:13:02.006492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-08-06T20:43:52.107028Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.02088","last_updated":"2025-08-07T11:09:06Z","snapshot_observed_at":"2026-08-09T23:48:38.544694Z","submitted_at":"2025-07-02T19:04:56Z","title":"McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T20:43:52.107028Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2507.02088"},"observation_digest":"sha256:0bd772504f0ab247467e9511c495f4f2afc577070d16245273a9cec20c4e9347","observation_id":"956799bb-5b48-4886-a37a-afef76e8b8bd","resolution":{"observed_at":"2026-08-06T20:43:52.107028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-08-05T22:21:05.877970Z","title":"Crows-pairs: A challenge dataset for measuring social biases in masked language models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.07111","last_updated":"2025-08-09T22:24:40Z","snapshot_observed_at":"2026-08-07T22:29:14.834815Z","submitted_at":"2025-08-09T22:24:40Z","title":"Investigating Intersectional Bias in Large Language Models using Confidence Disparities in Coreference Resolution","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T22:21:05.877970Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2508.07111"},"observation_digest":"sha256:8dc4b0e95f768097fc5297173be1695a8cecd9bc14701121bec4a2c81b72907f","observation_id":"58c20924-ff9c-45c0-9830-1ccea725e76b","resolution":{"observed_at":"2026-08-05T22:21:05.877970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-08-04T19:55:56.548322Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-08T06:23:27.336190Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.548322Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:bf6f2569058251f224b53750bc5ea60d9430e5d619711f6c59323acf0a9b19fc","observation_id":"3981cd43-c751-4627-810a-b9e4ba610def","resolution":{"observed_at":"2026-08-04T19:55:56.548322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-08-03T01:12:32.176313Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.10384","last_updated":"2026-06-16T12:57:20Z","snapshot_observed_at":"2026-08-04T14:29:31.250968Z","submitted_at":"2026-02-11T00:04:56Z","title":"When Tables Go Crazy: Evaluating Multimodal Models on French Financial Documents","version":4},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-03T01:12:32.176313Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2602.10384"},"observation_digest":"sha256:fbd0c7937551d3f0a6b2e033e6c54acebf9a2c85cb597700665979f1631ea039","observation_id":"b82a6b6e-1404-4b73-9f76-abb97ecb214a","resolution":{"observed_at":"2026-08-03T01:12:32.176313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":"2010.00133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-07-03T17:38:44.469211Z","title":"arXiv preprint arXiv:2010.00133 , year=","venue":null,"work_id":"98abd3ca-3f3e-4a42-8d54-3b7d50fe011a","year":2020},"citing_paper":{"arxiv_id":"2605.00382","last_updated":"2026-05-05T08:05:07Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T04:06:02Z","title":"Social Bias in LLM-Generated Code: Benchmark and Mitigation","version":3},"reference_index":146,"source":"arxiv_source","source_observed_at":"2026-05-09T19:34:51.433422Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2605.00382"},"observation_digest":"sha256:c7f31b047bb6adf238d01dfc6c084c17cd2ce1e2329fed0b7b1b7d508b83e8b0","observation_id":"3c42b4ce-a9d9-4f74-810d-221cf1e7e337","resolution":{"observed_at":"2026-05-11T15:36:08.686178Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":"2010.00133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-07-03T17:38:44.469211Z","title":"arXiv preprint arXiv:2010.00133 , year=","venue":null,"work_id":"98abd3ca-3f3e-4a42-8d54-3b7d50fe011a","year":2020},"citing_paper":{"arxiv_id":"2605.10639","last_updated":"2026-05-11T14:27:39Z","snapshot_observed_at":"2026-08-02T13:54:55.570407Z","submitted_at":"2026-05-11T14:27:39Z","title":"Navigating the Sea of LLM Evaluation: Investigating Bias in Toxicity Benchmarks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T05:28:45.453455Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2605.10639"},"observation_digest":"sha256:e0fd73638bb9cadce6eddd1cfd9fb91024a4d1350123e46ee53548bfae255a9f","observation_id":"adf7ac43-6339-4af9-9a3a-c029af57c42a","resolution":{"observed_at":"2026-05-12T05:31:23.870735Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":"2010.00133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-07-03T17:38:44.469211Z","title":"arXiv preprint arXiv:2010.00133 , year=","venue":null,"work_id":"98abd3ca-3f3e-4a42-8d54-3b7d50fe011a","year":2020},"citing_paper":{"arxiv_id":"2605.25492","last_updated":"2026-05-25T06:54:44Z","snapshot_observed_at":"2026-07-06T23:35:26.687529Z","submitted_at":"2026-05-25T06:54:44Z","title":"SafetyRepro: Configuration-Conditional Rank Instability on Alignment Benchmarks","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-29T22:50:48.263600Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2605.25492"},"observation_digest":"sha256:9005b92aaa158945d6d903c2ad7708323f8266d073199e94b3a42b520f764521","observation_id":"088dc25c-51b0-4bf0-bf5c-bf8b7116fbbe","resolution":{"observed_at":"2026-06-29T22:54:00.973683Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":"2010.00133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-07-03T17:38:44.469211Z","title":"arXiv preprint arXiv:2010.00133 , year=","venue":null,"work_id":"98abd3ca-3f3e-4a42-8d54-3b7d50fe011a","year":2020},"citing_paper":{"arxiv_id":"2605.26738","last_updated":"2026-05-26T09:12:14Z","snapshot_observed_at":"2026-07-06T23:36:34.652096Z","submitted_at":"2026-05-26T09:12:14Z","title":"KARMA: Karma-Aligned Reward Model Adaptation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-29T17:52:06.830441Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2605.26738"},"observation_digest":"sha256:f5b12c8fe4415e150347994f00308f6bf6c237a1e1c7f47bcd38a92c9cd02f09","observation_id":"979da584-358f-44a4-a9da-9f842a0443b5","resolution":{"observed_at":"2026-06-29T17:53:46.866135Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":"2010.00133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-07-03T17:38:44.469211Z","title":"arXiv preprint arXiv:2010.00133 , year=","venue":null,"work_id":"98abd3ca-3f3e-4a42-8d54-3b7d50fe011a","year":2020},"citing_paper":{"arxiv_id":"2606.12234","last_updated":"2026-06-10T15:42:15Z","snapshot_observed_at":"2026-08-05T00:08:40.346158Z","submitted_at":"2026-06-10T15:42:15Z","title":"On The Effectiveness-Fluency Trade-Off In LLM Conditioning: A Systematic Study","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-06-27T09:40:48.736006Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2606.12234"},"observation_digest":"sha256:21b52defa44a0972fb6f3dcd23c7ec02cbd02b8dcdab0aa36b73077ec631500f","observation_id":"254081b9-522e-4c6c-9f52-853f3a8e261b","resolution":{"observed_at":"2026-07-03T11:08:03.493479Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":"2010.00133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-07-03T17:38:44.469211Z","title":"arXiv preprint arXiv:2010.00133 , year=","venue":null,"work_id":"98abd3ca-3f3e-4a42-8d54-3b7d50fe011a","year":2020},"citing_paper":{"arxiv_id":"2606.16723","last_updated":"2026-06-15T13:50:26Z","snapshot_observed_at":"2026-08-07T03:01:48.166687Z","submitted_at":"2026-06-15T13:50:26Z","title":"AgentFairBench: Do LLM Agents Discriminate When They Act?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T03:53:38.554457Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2606.16723"},"observation_digest":"sha256:b2ed82c49bead87ac08d6ffd9ca63a5aad0421439809b5d07ca25a3340c53fa7","observation_id":"29904cd7-ad28-4077-9d5e-36ba742a7f6d","resolution":{"observed_at":"2026-07-03T17:38:44.470755Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-08-02T07:44:10.447865Z","title":"Long Ouyang, Jeffrey Wu, Xu Jiang, Diogo Almeida, Carroll L","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.22676","last_updated":"2026-07-10T11:11:48Z","snapshot_observed_at":"2026-08-09T15:01:07.301863Z","submitted_at":"2026-07-10T11:11:48Z","title":"How LLM Task-Adaptation Reshapes Alignment: A Multi-dimensional Study of Behavioral and Representational Drift","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T07:44:10.447865Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2607.22676"},"observation_digest":"sha256:e4ed3bcfc73431a5c7b84d6798309330d7504fcc31292e026804ec3673f7b2a1","observation_id":"da97eac8-1fb3-4ae9-8c6b-0d23d3ed6c0e","resolution":{"observed_at":"2026-08-02T07:44:10.447865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2010.00133/citation-record","integrity":"/paper/2010.00133/integrity","json":"/paper/2010.00133/citation-record.json","paper":"/paper/2010.00133"},"outbound":[],"paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2010.00133."}