{"as_of":"2026-08-05T15:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e6b0424a876ad27a6c16e5cca61cfdf8af34fd62d9b2afe810ae5a6aa2156a9f","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T19:55:11.431020Z","state":"measured"},{"denominator":104,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":104,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":39,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T14:55:56.858616Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T19:50:11.112541Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T13:35:55.949167Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2204.05862"},"observation_digest":"sha256:86e1b27d14c83e1b928af40c0710bffb8961b8a5ca4050c011f521e023b88b4a","observation_id":"4c783d77-e27b-47f4-bddd-f35b9b5e2f66","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-11T07:38:37.734402Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2206.07682"},"observation_digest":"sha256:c17aee0127c988d18457b713302daa6fec07ebbf49e395d0fe54d4076cb03494","observation_id":"a684a18d-1ef3-4024-b432-0bcd63120327","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-10T15:42:47.274448Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2207.05221"},"observation_digest":"sha256:bead86e75f67a669c8a9191991ff5c5bfde2e6aaceaae5d11cbb32a1a634792e","observation_id":"3e9a25a2-ee2c-439f-87a3-6dca4f4b6e72","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"reference_index":109,"source":"arxiv_source","source_observed_at":"2026-05-12T11:59:25.813128Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2305.10403"},"observation_digest":"sha256:f8f7700f30163c8ea1de57f64706010ba9acea94c9bc263e8a1a146fbe8b7e6c","observation_id":"5e4076f6-bc03-4077-b1a6-cbeaed5a3a31","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-24T05:00:28.453838Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2312.11805"},"observation_digest":"sha256:2a3cec918184c539058d57a415ed1dbbfe8c51b3a91f76fade11b41fea2447b9","observation_id":"40b53494-d224-41e5-98d6-41f9aa21c408","resolution":{"observed_at":"2026-05-24T05:03:55.357401Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-24T04:09:15.921778Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2401.04088"},"observation_digest":"sha256:ab76d1dc30c95ec21f6281adbdd704a60c27a6bdb53c1448db66baeace41763d","observation_id":"a4768c18-1387-446d-8d25-53e827410568","resolution":{"observed_at":"2026-05-24T04:13:53.805175Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2408.00724","last_updated":"2025-03-03T07:53:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-01T17:16:04Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","version":3},"reference_index":258,"source":"arxiv_source","source_observed_at":"2026-05-18T06:38:36.517935Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2408.00724"},"observation_digest":"sha256:14abbda61b0425a9e7d214c884616c9d5be670f39684f4caf6931c541b152563","observation_id":"c97b0f70-b78a-4084-acf6-c7fff7436dbb","resolution":{"observed_at":"2026-05-18T06:38:37.065158Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-23T06:39:44.542350Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2412.16720"},"observation_digest":"sha256:2fa33aeeb84720ce5252ecd186f167181c4391b1c15c1c4469dbc18d2a6748fb","observation_id":"a1dd87fe-d0c5-44fb-bb61-a7b86163e221","resolution":{"observed_at":"2026-05-23T06:42:39.669631Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2504.16155","last_updated":"2026-05-07T09:59:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:52:04Z","title":"PRIMETIME : Limits of LLMs in Temporal Primitives","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T18:36:48.376877Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2504.16155"},"observation_digest":"sha256:32c3f18dd3def5d331ebfa2f5fe6058b8e31e89a5d75e48129d1d0ff8f08d1c8","observation_id":"1ed6d3ca-3123-4b92-ae90-a8bbec1d8b6d","resolution":{"observed_at":"2026-05-22T18:36:58.690561Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-01T16:27:35.664983Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T12:22:54.633089Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2508.10925"},"observation_digest":"sha256:752b89959e0481fecb6e14c27768a60ee868cddd3bb989f164b626165f95649f","observation_id":"5abe97a1-7feb-4c6a-95aa-39fe5be885a6","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-08-05T14:55:56.858616Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20737","last_updated":"2025-08-28T13:00:28Z","snapshot_observed_at":"2026-08-05T14:55:55.701437Z","submitted_at":"2025-08-28T13:00:28Z","title":"Rethinking Testing for LLM Applications: Characteristics, Challenges, and a Lightweight Interaction Protocol","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T14:55:56.858616Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2508.20737"},"observation_digest":"sha256:debe5627ba2667dff9a38c6043443e18c7f227026c6d4ff639fad6f211cc2bcf","observation_id":"d6f73424-395e-4c40-9fbc-119d3a86cfcb","resolution":{"observed_at":"2026-08-05T14:55:56.858616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-08-04T19:58:54.683230Z","title":"M., and Bowman, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08960","last_updated":"2025-09-10T19:47:46Z","snapshot_observed_at":"2026-08-04T19:58:51.260565Z","submitted_at":"2025-09-10T19:47:46Z","title":"BRoverbs -- Measuring how much LLMs understand Portuguese proverbs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T19:58:54.683230Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2509.08960"},"observation_digest":"sha256:f7945d619432e3d66bc16e10f536c4eb0f933103c7d0fbb232240569fe7e5eb3","observation_id":"cfa6016c-09da-4a26-b8ff-22ac7c7da56c","resolution":{"observed_at":"2026-08-04T19:58:54.683230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-08-04T11:21:56.896943Z","title":"BBQ: A hand-built bias benchmark for question answering.arXiv preprint arXiv:2110.08193,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.05291","last_updated":"2026-05-27T02:09:31Z","snapshot_observed_at":"2026-08-04T11:21:53.198595Z","submitted_at":"2025-10-06T18:59:11Z","title":"Camellia: Benchmarking Cultural Biases in LLMs for Asian Languages","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T11:21:56.896943Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2510.05291"},"observation_digest":"sha256:c561ee013361b14c29f28aefd57e86ab22d772e78a2d70b7485c3ef3b4ae6253","observation_id":"d4684197-a5b6-4e84-9bc3-57b9be45ed1e","resolution":{"observed_at":"2026-08-04T11:21:56.896943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2511.10287","last_updated":"2026-04-07T03:18:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-13T13:18:27Z","title":"OutSafe-Bench: A Benchmark for Multimodal Offensive Content Detection in Large Language Models","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-17T22:29:36.960961Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2511.10287"},"observation_digest":"sha256:8a12df701632b811c5e6c3fc300c467ab7a72e3fe4af180c62129ad5e4b72907","observation_id":"d4be4337-c3df-4f26-9bef-f00021ce0cf8","resolution":{"observed_at":"2026-05-17T22:30:23.261552Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-08-03T19:25:20.617565Z","title":"Bbq: A hand-built bias benchmark for question answering.arXiv preprint arXiv:2110.08193, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2512.00807","last_updated":"2026-07-29T16:14:32Z","snapshot_observed_at":"2026-08-03T19:25:20.026820Z","submitted_at":"2025-11-30T09:33:09Z","title":"BioPro: Towards Difference-Aware Gender Fairness for Vision-Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T19:25:20.617565Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2512.00807"},"observation_digest":"sha256:189be5cd72ba48506764901b64dbb65a34f2519bbbc002538239637233ab8c95","observation_id":"6a5ab32b-2409-4e97-aca7-941daa891b7d","resolution":{"observed_at":"2026-08-03T19:25:20.617565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-02T10:52:10.211700Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T21:06:36.680344Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2601.03267"},"observation_digest":"sha256:cb8ebf636a1cc6d7089994b9fb41a7694b6c9f967dfff4b02aa7cd6530ec1bce","observation_id":"3cb9a689-5896-4784-b5f1-b936c093ed62","resolution":{"observed_at":"2026-05-16T21:08:32.627405Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-15T15:00:25.407602Z","title":"Bbq: A hand-built bias benchmark for question answering","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.04836","last_updated":"2026-07-06T01:38:24Z","snapshot_observed_at":"2026-07-15T15:00:24.595768Z","submitted_at":"2026-03-05T05:43:45Z","title":"Beyond Text: Aligning Vision and Language for Multimodal E-Commerce Retrieval","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-15T15:00:25.407602Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2603.04836"},"observation_digest":"sha256:abdbeaadefbf67be607d91849863a77e3c319bff9be6b1be9de4669196a9da6b","observation_id":"3c15405d-ebaf-4629-bf64-be48dc16636d","resolution":{"observed_at":"2026-07-15T15:00:25.407602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2604.03121","last_updated":"2026-04-03T15:45:35Z","snapshot_observed_at":"2026-07-06T22:52:20.577677Z","submitted_at":"2026-04-03T15:45:35Z","title":"An Independent Safety Evaluation of Kimi K2.5","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-13T19:38:18.674355Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2604.03121"},"observation_digest":"sha256:1487854d46f34b722518fdb1df289d095f0895c042e94708acabf4358de8acd6","observation_id":"f8111af8-0177-4c93-afbb-188d8a5cbe65","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2604.06233","last_updated":"2026-04-03T13:53:23Z","snapshot_observed_at":"2026-07-06T22:54:44.656835Z","submitted_at":"2026-04-03T13:53:23Z","title":"Blind Refusal: Language Models Refuse to Help Users Evade Unjust, Absurd, and Illegitimate Rules","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-13T19:24:54.381722Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2604.06233"},"observation_digest":"sha256:b3e6bb916bd8b8e1b224d8e4ebb49f1da5610a95ac10f4867e8d2d4aca87ac70","observation_id":"71a3039e-92be-4d0e-9f05-3f66ec1a1fcc","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2604.08963","last_updated":"2026-04-13T05:54:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-10T05:06:38Z","title":"Aligned Agents, Biased Swarm: Measuring Bias Amplification in Multi-Agent Systems","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T17:25:01.741390Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2604.08963"},"observation_digest":"sha256:4142e8bac0ddd435536a79d9ca907056ba8cf9a50290c24ce129f5787d816a5a","observation_id":"da35c767-df0d-4f8d-abbb-4e8227feca90","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2604.09034","last_updated":"2026-04-10T06:52:58Z","snapshot_observed_at":"2026-07-06T22:57:59.555972Z","submitted_at":"2026-04-10T06:52:58Z","title":"The nextAI Solution to the NeurIPS 2023 LLM Efficiency Challenge","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T17:52:30.463227Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2604.09034"},"observation_digest":"sha256:68e39a783bceb38d1d384bafab5fb8630b727b457e49d5f04374fd4940e6feb4","observation_id":"d16c5ad5-0ae2-4cb9-bf13-9e876bc35ff7","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2604.12946","last_updated":"2026-04-14T16:43:37Z","snapshot_observed_at":"2026-07-06T23:01:05.634599Z","submitted_at":"2026-04-14T16:43:37Z","title":"Parcae: Scaling Laws For Stable Looped Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-10T15:33:04.442462Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2604.12946"},"observation_digest":"sha256:deecdaf8fb8074b4b10aa698128c8573575c08e9dec8d5a3ce34af210d14b7ea","observation_id":"896852d9-94b8-4d46-8ec7-c3c628d8e377","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2604.13103","last_updated":"2026-04-10T13:49:49Z","snapshot_observed_at":"2026-08-03T00:10:56.297533Z","submitted_at":"2026-04-10T13:49:49Z","title":"Fairness in Multi-Agent Systems for Software Engineering: An SDLC-Oriented Rapid Review","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T17:11:23.553461Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2604.13103"},"observation_digest":"sha256:7603e22c9ddaa926bd5f8323e03a938c4acf76fa5cfcc941442b1715ee737d1d","observation_id":"2c322100-a65a-4431-b45a-c36bc06bb4e1","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2604.17008","last_updated":"2026-04-18T14:39:15Z","snapshot_observed_at":"2026-07-06T23:04:14.688737Z","submitted_at":"2026-04-18T14:39:15Z","title":"BIASEDTALES-ML: A Multilingual Dataset for Analyzing Narrative Attribute Distributions in LLM-Generated Stories","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-10T06:53:20.673245Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2604.17008"},"observation_digest":"sha256:27a26ae11e37982b4c409088abc344c32764fee79f5289c6bd2f4dfd582c01a1","observation_id":"6b47ea13-cdb0-4667-8caf-994c4154d4ac","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2604.20677","last_updated":"2026-04-23T01:37:34Z","snapshot_observed_at":"2026-07-06T23:07:14.243878Z","submitted_at":"2026-04-22T15:25:47Z","title":"Intersectional Fairness in Large Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-09T23:44:08.610255Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2604.20677"},"observation_digest":"sha256:43e724aba2cd9e702c37b2a74734c56f5c527219971ebbf041c34d405439e018","observation_id":"4def937d-c001-4579-bed3-268f645577e9","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2604.22749","last_updated":"2026-04-24T17:49:09Z","snapshot_observed_at":"2026-07-06T23:09:05.682387Z","submitted_at":"2026-04-24T17:49:09Z","title":"Representational Harms in LLM-Generated Narratives Against Global Majority Nationalities","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-08T11:45:58.139592Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2604.22749"},"observation_digest":"sha256:d2efba8764dfd4e5fdee82f4c549cd077166a3797082ecba0d2afb7140ed2e14","observation_id":"674a9b54-4c6d-4e69-9cce-d64a51d26ceb","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2605.00382","last_updated":"2026-05-05T08:05:07Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T04:06:02Z","title":"Social Bias in LLM-Generated Code: Benchmark and Mitigation","version":3},"reference_index":154,"source":"arxiv_source","source_observed_at":"2026-05-09T19:34:51.433422Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2605.00382"},"observation_digest":"sha256:77dc44d2044da59fe87445355afc470e99124864ca4a45b6717bb755269c8318","observation_id":"e1e65bc5-efd9-4e6c-bd8a-b5997f25675f","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2605.10639","last_updated":"2026-05-11T14:27:39Z","snapshot_observed_at":"2026-08-02T13:54:55.570407Z","submitted_at":"2026-05-11T14:27:39Z","title":"Navigating the Sea of LLM Evaluation: Investigating Bias in Toxicity Benchmarks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T05:28:45.453455Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2605.10639"},"observation_digest":"sha256:5e3c4ba11ad17e2067e66aa951840e916c5b4198e10257a7cbf51cf66bfa1b82","observation_id":"844ba86d-f80a-452a-a49b-286dad87348d","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2605.12530","last_updated":"2026-04-21T18:38:50Z","snapshot_observed_at":"2026-07-06T23:24:13.851504Z","submitted_at":"2026-04-21T18:38:50Z","title":"In-Situ Behavioral Evaluation for LLM Fairness, Not Standardized-Test Scores","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T21:31:14.913156Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2605.12530"},"observation_digest":"sha256:5964566bdeb5ed8c955e66f582b60f6fde264346c5295b95e96c437085813636","observation_id":"6cbd78f2-4ac1-48af-9f97-6e5d27730cbd","resolution":{"observed_at":"2026-05-16T19:55:11.638110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2605.25492","last_updated":"2026-05-25T06:54:44Z","snapshot_observed_at":"2026-07-06T23:35:26.687529Z","submitted_at":"2026-05-25T06:54:44Z","title":"SafetyRepro: Configuration-Conditional Rank Instability on Alignment Benchmarks","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-29T22:50:48.263600Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2605.25492"},"observation_digest":"sha256:17583c8f548b2fafe3245b4476ebfa424e431b787ad2ec394a6105b29dbcf834","observation_id":"dafc4d39-80e5-4eb5-a371-26466f66dbd4","resolution":{"observed_at":"2026-06-29T22:54:00.962190Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2606.06244","last_updated":"2026-06-04T14:48:23Z","snapshot_observed_at":"2026-07-06T23:46:05.829177Z","submitted_at":"2026-06-04T14:48:23Z","title":"Steering LLM Viewpoints through Fabricated Evidence Injection","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-28T00:36:32.258208Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2606.06244"},"observation_digest":"sha256:d0943aeee099adf7156ddbb5fe85b6d2de7dbe48ee83682a7b39f0089bca5a12","observation_id":"81d6dd0b-aa44-4448-9318-e9ba8326e181","resolution":{"observed_at":"2026-07-02T14:17:02.777573Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2606.16723","last_updated":"2026-06-15T13:50:26Z","snapshot_observed_at":"2026-08-01T18:16:06.789134Z","submitted_at":"2026-06-15T13:50:26Z","title":"AgentFairBench: Do LLM Agents Discriminate When They Act?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T03:53:38.554457Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2606.16723"},"observation_digest":"sha256:3d123658cf45782247ff048dd84ba1af55ca2cab373a950427b52e0cfbd453a7","observation_id":"47efa72f-013d-4d5b-ba1b-1005df042f59","resolution":{"observed_at":"2026-07-03T17:38:44.468165Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2606.17168","last_updated":"2026-06-20T10:01:32Z","snapshot_observed_at":"2026-07-06T23:52:47.494791Z","submitted_at":"2026-06-15T18:06:59Z","title":"RepSelect: Robust LLM Unlearning via Representation Selectivity","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-27T03:34:32.388152Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2606.17168"},"observation_digest":"sha256:2a1265a1f2d1fb220d4fd6d1e0610341024b9420c75f1cec7810b9b72e3d21ef","observation_id":"fd477357-fd9b-4e02-a4d9-0598e35574c9","resolution":{"observed_at":"2026-07-03T17:58:47.251596Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":"2110.08193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-04T19:50:11.112541Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","venue":"cs.CL","work_id":"6f78b350-8a2a-4d00-9090-41971c52baaf","year":2021},"citing_paper":{"arxiv_id":"2606.25476","last_updated":"2026-07-21T11:09:35Z","snapshot_observed_at":"2026-08-05T14:35:29.607331Z","submitted_at":"2026-06-24T07:00:53Z","title":"A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-25T20:58:53.119386Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2606.25476"},"observation_digest":"sha256:d99cf3b3d741600fa718313229740dd8b22d0473cc7c84dd716d5ac5db266d66","observation_id":"222b8692-bf42-4fad-96b3-b4ff81fa0096","resolution":{"observed_at":"2026-07-04T19:50:11.114313Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-08-02T10:16:45.615953Z","title":"arXiv preprint arXiv:2110.08193 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.25476","last_updated":"2026-07-21T11:09:35Z","snapshot_observed_at":"2026-08-05T14:35:29.607331Z","submitted_at":"2026-06-24T07:00:53Z","title":"A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-02T10:16:45.615953Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2606.25476"},"observation_digest":"sha256:b5de728da22318ffb7338973ddb38fb77f9b50371ce8ac76839cd2a1ffaa9b90","observation_id":"865b7f39-a77e-4e37-83d0-ec31eca0b296","resolution":{"observed_at":"2026-08-02T10:16:45.615953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-08-02T14:07:58.834415Z","title":", booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20448","last_updated":"2026-05-13T15:26:50Z","snapshot_observed_at":"2026-08-04T19:07:58.130132Z","submitted_at":"2026-05-13T15:26:50Z","title":"Domyn-Small: A European 10B Reasoning Language Model","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-02T14:07:58.834415Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2607.20448"},"observation_digest":"sha256:ac8a7dae0f7246662593eb033b690ee1025d37e8b383e14ac6445b05077c7f71","observation_id":"b7b0ee3b-373c-4f4a-9113-c63607c4890d","resolution":{"observed_at":"2026-08-02T14:07:58.834415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-08-02T07:44:10.724281Z","title":"11 Ethan Perez, Sam Ringer, Kamile Lukosiute, Karina Nguyen, Edwin Chen, Scott Heiner, Craig Pettit, Catherine Olsson, Sandipan Kundu, and Saurav Kadavath","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22676","last_updated":"2026-07-10T11:11:48Z","snapshot_observed_at":"2026-08-02T07:44:06.805855Z","submitted_at":"2026-07-10T11:11:48Z","title":"How LLM Task-Adaptation Reshapes Alignment: A Multi-dimensional Study of Behavioral and Representational Drift","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T07:44:10.724281Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2607.22676"},"observation_digest":"sha256:54893471733095fba760eb71e368a3ed0205dce352cca3c16807202ed50d2d2e","observation_id":"2a7d4085-942d-4811-a70d-16f853adca04","resolution":{"observed_at":"2026-08-02T07:44:10.724281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-08-01T17:37:53.647810Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26355","last_updated":"2026-07-29T00:08:35Z","snapshot_observed_at":"2026-08-04T06:32:42.498031Z","submitted_at":"2026-07-29T00:08:35Z","title":"Symphony of Bias: Exploring Gender Associations with Musical Instruments in Multimodal LLMs","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T17:37:53.647810Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2607.26355"},"observation_digest":"sha256:e2bd175ff7c113ecf688ef3d79ebb1a334b3eb95f6fe3a1ec5e70453dd2348ac","observation_id":"16c6a671-e179-469e-9458-f10409614404","resolution":{"observed_at":"2026-08-01T17:37:53.647810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-07-31T11:25:39.434727Z","title":"BBQ: A hand-built bias benchmark for question answering,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28319","last_updated":"2026-07-30T14:54:33Z","snapshot_observed_at":"2026-08-03T00:09:53.699212Z","submitted_at":"2026-07-30T14:54:33Z","title":"Fairness Pruning: Locating Demographic Bias in GLU-MLP Layers via Differential Activations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T11:25:39.434727Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2607.28319"},"observation_digest":"sha256:3e6e2d8823bb91313feeabfe21d460dd46b747e906e93317b06b570442e9f2ed","observation_id":"8e02feda-2224-4102-9c7d-1adcd77dbcc8","resolution":{"observed_at":"2026-07-31T11:25:39.434727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2110.08193/citation-record","integrity":"/paper/2110.08193/integrity","json":"/paper/2110.08193/citation-record.json","paper":"/paper/2110.08193"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4bb48d73-eebb-4fa3-990a-ffbbb212015f","year":2009},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:0f58435dee4749e17ce1eaa5a183e4c10ddce12721b03c5e093038ee96e876f3","observation_id":"f1455e15-20cd-4ac0-9bc0-cec3adce411b","resolution":{"observed_at":"2026-05-16T19:55:11.586395Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ba726d32-bf30-44df-8ad6-f0327957c9d3","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:1e467fd340c26a1b7bd0e835cc684637d04c16c1b6fc1f4e4d0bbad5364229b6","observation_id":"67dcfcea-cfc2-4019-80d2-b396ba76cd2a","resolution":{"observed_at":"2026-05-16T19:55:11.590455Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1126/science.aal4230","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bryson, and Arvind Narayanan","venue":"Science","work_id":"5f928ccc-c92a-435c-a75a-67f4e14fecce","year":2017},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:ee614cda6aaca3e24af943f6713464df844beb79f8ec91b58eea84e1d7071575","observation_id":"8b69c5f8-94fb-4520-911c-00d4565873f8","resolution":{"observed_at":"2026-05-16T19:55:11.491358Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T12:48:57.929954+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T12:48:57.929954+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4b779e1c-7a5e-4dd6-945d-655514f642b6","year":2021},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:daa0469d56360f4743f514a8dc930a035c01fdb5be82f88368a6908427aa844e","observation_id":"34950dba-b5d7-4445-9d65-59b1c68167a2","resolution":{"observed_at":"2026-05-16T19:55:11.592386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":"1803.05457","doi":"10.1162/tacl_a_00448.https://aclanthology.org/2022.tacl-1.5","metadata_source":"pith","pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","venue":"cs.AI","work_id":"28ea1282-d657-4c61-a83c-f1249be6d6b1","year":2018},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:443e7bce28d4474e6034365375450864dafda13043b161de0886ce6da09582bf","observation_id":"9b76bfd0-c537-4165-94b7-ef6cb54d220a","resolution":{"observed_at":"2026-05-16T19:55:11.539465Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"03d73cf0-4906-43b9-98df-f1f9a6e863cc","year":2017},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:f92147428a1b4e4c03d21ac08f36f221e9e9a69f8ce3aec2a7ba00c66f0c3622","observation_id":"63f64783-de7b-4475-a6e6-709a33096316","resolution":{"observed_at":"2026-05-16T19:55:11.594409Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4851.2015","doi":"10.1080/13504851.2015.1114571","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Applied Economics Letters","work_id":"12a8a395-8110-4662-8e31-c2cbf2bf41e5","year":2016},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:b809a5bd0cfa48966568c31387b927c0cfe5259a47031a52f93e7910da845ef8","observation_id":"08305f7a-f6c8-4659-99eb-c48a5a1931c8","resolution":{"observed_at":"2026-05-16T19:55:11.496093Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9b5c1ce0-2794-4cb1-9e5e-1b15b2cdaa14","year":2021},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:54254070adf631f24d93c10c77ef07708a9d37c38750da2216e70dab42535e8b","observation_id":"90b4807c-ba7a-4116-b95d-c2c7423d3894","resolution":{"observed_at":"2026-05-16T19:55:11.596500Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"cited_work":{"arxiv_id":"2111.09543","doi":"10.48550/arxiv.2111.09543","metadata_source":"pith","pith_arxiv_id":"2111.09543","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","venue":"cs.CL","work_id":"480bf7dd-7121-4d1f-8b53-7cc6ce479835","year":2021},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"cited_paper":"/paper/2111.09543","citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:3b4bf260115bf90ae3a198610d48799b8e9be67c85697e907488ea9eba94a328","observation_id":"ac732f1f-618a-4562-a16c-8d36929dd78f","resolution":{"observed_at":"2026-05-16T19:55:11.547348Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T13:20:40.796158+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T13:20:40.796158+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ff4c1856-2c45-4f6b-91eb-d084e92bad1f","year":1993},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:853cd6c82b6b1a5e5f430ada8abca887c2866986aff04ef5f887520f99ed11e1","observation_id":"00e66416-cd52-47be-8a53-4c132c87652c","resolution":{"observed_at":"2026-05-16T19:55:11.598438Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4ede178c-88f9-4843-adac-18577df845e3","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:5a906abfbcf23cb773ca06ccca6a53230fffe9015378527cf64179bb57247544","observation_id":"7ef22494-5074-4e12-a87e-725cc360ebe7","resolution":{"observed_at":"2026-05-16T19:55:11.600675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"de7680c1-a701-442f-b586-79de860df52a","year":2014},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:a1bfcfeaf29edf1141fb4362589714002cea9e909f6adf475bb905ad2dda2524","observation_id":"74ea2712-d230-4741-9d5d-d309969aff6c","resolution":{"observed_at":"2026-05-16T19:55:11.602762Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":"1907.11692","doi":"10.1007/s10489-02203627-9","metadata_source":"pith","pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","venue":"cs.CL","work_id":"41fe12c4-e538-4890-a244-480650ed3078","year":2019},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:10bb1305159e5347f408f27ee5d12690e388f03f7c93d5162c33281575bec519","observation_id":"e7a923c0-3bb6-4c42-89e1-ffbf286e753a","resolution":{"observed_at":"2026-05-16T19:55:11.543523Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-62077-6_14","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Logic, language, and security: Essays dedicated to Andre Scedrov on the occasion of his 65th birthday , pages=","venue":"Lecture notes in computer science","work_id":"c67eecd5-e2c4-4d7d-af1b-0d29cdbbd57d","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:87f28209f00b557888fcb9511dc8efc71cd6c3318e8338f368557d735a36428b","observation_id":"cdbbbd62-a98a-4979-a48b-e85b737fd481","resolution":{"observed_at":"2026-05-16T19:55:11.506080Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"69a9ad20-a8ad-4a0e-ae7f-dcce650327d8","year":2018},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:afeb6bc07fa8c13e7763aea6b7266dc75527d10de2f06435543b1eb8ecf219a9","observation_id":"7f824bfd-5344-474f-9e2d-6c01909ddd31","resolution":{"observed_at":"2026-05-16T19:55:11.604896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1bbfd10d-a3a0-4776-98b5-fd053b6cdc3d","year":1994},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:bae5cdc5c4db4e7ba6d6ec77876260ff66a779d18a34531d02f86fe675286cb9","observation_id":"2b51bb88-0990-4832-a0d2-90ae7ef9b2b4","resolution":{"observed_at":"2026-05-16T19:55:11.606857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"741141f2-208d-49dd-a385-2e947303f9a8","year":2021},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:35a50cb787d924d0539766659a066b178b00ec61dd42e79b1fc40dfc2e50f30f","observation_id":"4bbdfd7b-9590-4825-b5b6-83e21ce03e7e","resolution":{"observed_at":"2026-05-16T19:55:11.608721Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c8c407dd-0895-473f-9125-9aadafb1e323","year":2021},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:9aa5346ca5dcde9bf6a9d4f97e18f33f825e5dcb4595c06b484f23ba4c85ab66","observation_id":"a1db20b6-963f-4a68-9a4e-afca8ea6a452","resolution":{"observed_at":"2026-05-16T19:55:11.610667Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cfcb23b7-9b82-4cfd-825b-04bb94e41a5c","year":2018},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:267d6250feb518786ad1207502ffe4b3adb8bd0bcd7b04a3b1ff890c4365537b","observation_id":"1f47875a-a43c-4ff4-8b63-54900214fce2","resolution":{"observed_at":"2026-05-16T19:55:11.612800Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"74826f73-2024-4098-bf33-2eeeac00ecbf","year":1990},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:09f1244363b412f08977c06446c6a2d7c1e209dee1f10500f75e9bc2c69ace8b","observation_id":"a7b514da-175e-41e5-829e-58933b56714a","resolution":{"observed_at":"2026-05-16T19:55:11.614875Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a149e179-4ff8-4b69-8f12-c69482d018d0","year":2018},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:e7090cdc1ae615ddffd44052e20ab1b5d8e589e60e4e044c38ea9366a54a45e5","observation_id":"06553522-93bb-46b1-9024-78e8f9a208e6","resolution":{"observed_at":"2026-05-16T19:55:11.616851Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1179/nam.1999.47.1.21","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"They call me Bruce , but they won't call me Bruce Jones","venue":"Names","work_id":"89b340d6-1528-48a4-979b-f402c1fe8475","year":1999},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:dc240468f4b350b7911c8c10664bc291532ce605759bc0e180e5b85f94942c96","observation_id":"fed949e6-574a-4605-a2de-2fb8e78d3cdc","resolution":{"observed_at":"2026-05-16T19:55:11.475434Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"38c5fc8e-3cfe-42da-acc3-078df88a3fdf","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:9a44fea072b5f7a719b7ad9692362af2e248fe80842a1ff10d2714067387aee7","observation_id":"3403acc3-cedb-4690-a260-0d8c66727915","resolution":{"observed_at":"2026-05-16T19:55:11.619057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2020 , url=","venue":null,"work_id":"e9627b7b-e2e4-4563-9509-6addc07ff4d7","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:bce6b962895664b2ae079a9ccfaf5d9c774c047667b0230fed13fe1971c7bd62","observation_id":"8df5887a-dcbc-4f89-9ff0-a1a7d7ca3caf","resolution":{"observed_at":"2026-05-16T19:55:11.621092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.findings-emnlp.311","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UNQOVER ing Stereotyping Biases via Underspecified Questions","venue":null,"work_id":"197da07e-d522-4dbe-8d5c-e1017e41e583","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:345cb2d8880aa0869f13212e71b027924389b28288cadbe773ccb31b80cab2e8","observation_id":"67835a58-8bdf-428f-9805-53e5d1a86b90","resolution":{"observed_at":"2026-05-16T19:55:11.462741Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09456","last_updated":"2020-04-20T17:14:33Z","snapshot_observed_at":"2026-07-06T09:13:46.854094Z","submitted_at":"2020-04-20T17:14:33Z","title":"StereoSet: Measuring stereotypical bias in pretrained language models","version":1},"cited_work":{"arxiv_id":"2004.09456","doi":"10.48550/arxiv.2004.09456","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.09456","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Stereoset: Measuring stereotypical bias in pretrained language models","venue":null,"work_id":"888145e4-063c-4dfa-a079-b13b5a5d50e2","year":2021},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"cited_paper":"/paper/2004.09456","citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:91690654eb950c1e6723da49a134d01917124c901834e8217ab6e50f96837a6a","observation_id":"83f2ec41-6380-4ffc-ae4c-3e732c164d70","resolution":{"observed_at":"2026-05-16T19:55:11.526488Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:26:01.210371+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:26:01.210371+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":"2010.00133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-07-03T17:38:44.469211Z","title":"arXiv preprint arXiv:2010.00133 , year=","venue":null,"work_id":"98abd3ca-3f3e-4a42-8d54-3b7d50fe011a","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:68c7e3e6a734d29599b50d03ec8277b321a26cac9a8407cc73cecdb0386ebfd2","observation_id":"9a077b82-d57f-43c1-ac94-05b8d5ebfae8","resolution":{"observed_at":"2026-05-16T19:55:11.531159Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d19-1339","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/D19-1339","venue":null,"work_id":"ab1d6b4f-364e-4aea-91e5-c3992b422ca9","year":2019},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:d8b02b437bf4a61dcf3511a0ec575ad6240a34a293bbd54163bb54974284c14e","observation_id":"1a1e1add-84e3-4e2c-8c13-77c95c397ac0","resolution":{"observed_at":"2026-05-16T19:55:11.499850Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language (technology) is power: A critical survey of\" bias\" in","venue":null,"work_id":"51b2ba4d-fb67-4391-84e7-e6de6ee31736","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:b0d71f25add9a4b2e4528fbeabfb481cc78b12331ff55e54f9a8d785193a4743","observation_id":"186e96b1-99f0-40a2-b1b1-17e98df9b340","resolution":{"observed_at":"2026-05-16T19:55:11.623205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2017 , note=","venue":null,"work_id":"f3c0e6f0-4be7-4431-b25b-a8fe88be7257","year":2017},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:60680bbc9905b6e3e80f414c1ecebf425a5f5f088fe0d91bebbb61aaf85a47e4","observation_id":"45cecc5a-5d6d-4519-a53b-6e121a416624","resolution":{"observed_at":"2026-05-16T19:55:11.625435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2021 , note=","venue":null,"work_id":"3a868409-f4a2-435b-b183-f216eb274576","year":2021},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:1d5dd4b9728f5a76f3c2fb166c2bc2940368360f9c8296232d1186be0b81dbb9","observation_id":"9b43bc0d-8076-43aa-ac8d-3787d91d9d3c","resolution":{"observed_at":"2026-05-16T19:55:11.627603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transactions of the Association for Computational Linguistics , volume=","venue":null,"work_id":"d618c38f-ac36-4292-889a-e835c09c6cdc","year":2018},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:047a7fc40da9b61256d80e87b5a873d31c26e9217e5aff0f84102e6f66f28079","observation_id":"7fad8a98-e7b8-4f51-bf3b-8e5c7765eb85","resolution":{"observed_at":"2026-05-16T19:55:11.629658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.acl-main.486","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Smith, and Yejin Choi","venue":null,"work_id":"bc17444c-0095-4bbe-bb41-bb7069e0514c","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:8af3eb297638be653e74f82585e04193b196baf2838edff0671753c943fa4de7","observation_id":"e9a29992-e0e8-4657-ae3e-328b2bf4ead2","resolution":{"observed_at":"2026-05-16T19:55:11.508978Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T10:23:53.754958+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T10:23:53.754958+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.acl-main.418","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Toward Gender-Inclusive Coreference Resolution","venue":null,"work_id":"7dd869fd-5b57-4030-b236-65c192633858","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:83644afc08754001e0a406e9042763e241b7be31251e6943fd00b052a02da6b5","observation_id":"b9c31707-da84-48b2-b716-75cdb97a8685","resolution":{"observed_at":"2026-05-16T19:55:11.511845Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n18-2002","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gender bias in coreference resolution","venue":null,"work_id":"dd3cc35b-faeb-496d-858e-fa780c467425","year":2018},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:2be6578163bd995b65241dc42f4322c6309a3abc7391add1f53127e190676bbc","observation_id":"69a55b36-9709-44a5-9641-778476e6a936","resolution":{"observed_at":"2026-05-16T19:55:11.514734Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-17T23:20:56.59542+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T23:20:56.59542+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n18-2003","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gender Bias in Coreference Resolution: Evaluation and Debiasing Methods","venue":null,"work_id":"debd34b6-f412-41f5-8776-18ca1afb906a","year":2018},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:ae7a367465fa8a92c00e9466ea5e4f0e27368620001f3c8e5110effa87b84f14","observation_id":"13d036fc-5bec-43d4-bf3b-97e30c7f7d9c","resolution":{"observed_at":"2026-05-16T19:55:11.517570Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Logic, Language, and Security , pages=","venue":null,"work_id":"05c85df1-916b-4687-8694-7f94bba4d06a","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:146a0decba530deadbae40a3f12c4af464c6e4366985610be0752b62de717194","observation_id":"c2f2fd4f-6abe-4b35-a6cb-053899f6c275","resolution":{"observed_at":"2026-05-16T19:55:11.631713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.03362","last_updated":"2022-10-13T22:38:20Z","snapshot_observed_at":"2026-07-06T11:36:21.436620Z","submitted_at":"2021-08-07T04:08:47Z","title":"On Measures of Biases and Harms in NLP","version":2},"cited_work":{"arxiv_id":"2108.03362","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2108.03362","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On measures of biases and harms in nlp","venue":null,"work_id":"6e5fa964-5089-4dbd-a7b5-d438bcea191e","year":2021},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"cited_paper":"/paper/2108.03362","citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:2e938eb09303445717967b9a47c5356e8124de8893f8bf8feb58f1729d71ccdd","observation_id":"1f0ca1b5-cf88-4484-aab7-b96e29271fca","resolution":{"observed_at":"2026-05-16T19:55:11.535267Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2019 , url=","venue":null,"work_id":"8d2b4ec8-0811-4d24-8dfa-eb6e412c6e55","year":2019},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:ff1e5e790881e79dce7281031bea01e1a37facbe7b267e77da092dfc8a79e781","observation_id":"48f632dd-6f5f-47de-8d54-55d3b7933a72","resolution":{"observed_at":"2026-05-16T19:55:11.633666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sociological methodology , pages=","venue":null,"work_id":"0adb4089-5e28-4fe8-a93d-d6e1641474aa","year":1994},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:22cbe538eb58b95b92a5fa3740c6272281022c89bebcbf8b74939e428db10342","observation_id":"a6ee8345-86fb-42ae-87ae-d5ce7750b3bb","resolution":{"observed_at":"2026-05-16T19:55:11.635506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bryson and Arvind Narayanan , title =","venue":null,"work_id":"09cf21bf-215e-4b46-8307-4c4cd3759c5c","year":2017},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:149ba7d3a5aa7d7b50fec45aa5f091f87221c40ccdc9c14b25a31b9aedc6f87a","observation_id":"b1a85a50-3c0d-4308-8876-758821c23e10","resolution":{"observed_at":"2026-05-16T19:55:11.637342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n19-3002","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Identifying and Reducing Gender Bias in Word-Level Language Models","venue":null,"work_id":"6df3df85-8d74-4df6-b6ed-d287ef0b4821","year":2019},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:63ae04b38bed09ecfbafe7bb81d2c6a51256f47829d0aeaa869841062826d02a","observation_id":"ceceadac-7f4a-4ec5-b876-89aa53ac95ce","resolution":{"observed_at":"2026-05-16T19:55:11.466088Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n19-1063","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Rudinger, Rachel","venue":null,"work_id":"88f8dce9-17cc-41c1-a26a-e9b502ca0742","year":2019},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:9d180a5bd2af357ee41058c7780da82776afcebb99dbb356dc419d6d2c6a2a24","observation_id":"5d486721-e29b-4e25-820d-c1876fa3dfed","resolution":{"observed_at":"2026-05-16T19:55:11.469312Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T12:48:58.740552+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T12:48:58.740552+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/w19-3504","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Racial Bias in Hate Speech and Abusive Language Detection Datasets","venue":null,"work_id":"f2314c57-57a3-497e-8d2c-45073aa55eef","year":2019},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:ea716924b90c4f42f5329ded84f22ce1ae9786682dd1bd65749c6fc4daa99f02","observation_id":"1ac51d2a-c9a0-4db2-8165-db316d3e4967","resolution":{"observed_at":"2026-05-16T19:55:11.472107Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.07691","last_updated":"2021-07-16T03:46:08Z","snapshot_observed_at":"2026-07-06T11:29:41.025356Z","submitted_at":"2021-07-16T03:46:08Z","title":"Intersectional Bias in Causal Language Models","version":1},"cited_work":{"arxiv_id":"2107.07691","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.07691","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2107.07691 , year =","venue":null,"work_id":"28e73cf6-0414-41b4-80b2-0381a4a2f394","year":null},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"cited_paper":"/paper/2107.07691","citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:10a310be18fa38fc12281601e4ddee0f18a89112ca30c1a45909bf34ca2434c8","observation_id":"e77f2142-9d6a-401d-aa88-43c66c1018f1","resolution":{"observed_at":"2026-05-16T19:55:11.521997Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"H ate C heck: Functional Tests for Hate Speech Detection Models","venue":null,"work_id":"bd210790-d46b-475f-94cd-c1fd8d13b593","year":2021},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:92876b4d96558a6711c44c5633b25c0e414cd6058741070ae06f566d690c5a29","observation_id":"47d2f92f-c555-484f-aaac-a80989b7d40e","resolution":{"observed_at":"2026-05-16T19:55:11.550192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the NeurIPS 2020 Workshop on Dataset Curation and Security , year=","venue":null,"work_id":"75d12433-99c0-4678-a4e5-1281ffcf5799","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:db75dfa68153e550f9455e98cbc2f1f5f5d43c45be913a8b64c503ef054e277f","observation_id":"ff28db8d-704c-4bda-83f7-ec2c4b50e09e","resolution":{"observed_at":"2026-05-16T19:55:11.553264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2018 , url =","venue":null,"work_id":"ade1f071-4b07-4047-9597-1e0f38934877","year":2018},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:ff2aca6ea62c0bb7a49a7e53fbc39d84bd2652aff7e972294545dfc929a71c91","observation_id":"182a84aa-dff1-4378-8227-e79419b7a1ec","resolution":{"observed_at":"2026-05-16T19:55:11.555687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"070643e1-ca57-43bf-ac5c-56b4bedb0a9e","year":1999},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:0ea6ef60be99b19ca6dadb1cfe2230fbacd8173e4a8377979d7d712595c03d82","observation_id":"f684baac-9c86-4f6a-9edd-45915f66e10e","resolution":{"observed_at":"2026-05-16T19:55:11.558547Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2021 , publisher=","venue":null,"work_id":"1a53919d-2da0-43b7-935a-7ab2a56ab608","year":2021},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:59423ea391e46f686d5b329ce8e82c1439f3e97959c331cc41f7a9d9d1b87a21","observation_id":"69035c08-534c-4774-93b4-769f4fe19bef","resolution":{"observed_at":"2026-05-16T19:55:11.562105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n19-1424","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"What ' s in a Name? R educing Bias in Bios without Access to Protected Attributes","venue":null,"work_id":"2e401093-d3cf-4d4b-9603-916bd58a9128","year":2019},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:6125540023e2f141dbaeeaaabd981e21af92cab3bd3ddbb0ce69639bdd31762a","observation_id":"98207bae-901e-40c9-984e-1f782a7128c7","resolution":{"observed_at":"2026-05-16T19:55:11.503241Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"author=","venue":null,"work_id":"c9469f6a-dc85-46fb-9545-fbf0cc173ded","year":1993},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:7069856801c3dcd3bece448c79ada9a1d6a0f5eb016d7c342a26007394f96c58","observation_id":"5480bd3d-0580-474f-bc6f-1025e440b65f","resolution":{"observed_at":"2026-05-16T19:55:11.565569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Applied Economics Letters , volume=","venue":null,"work_id":"24baf170-d7cc-4c20-b163-dc727e75521f","year":2016},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:6ca85e9026b0a130f96e6266975aef1eec505c8e2d20edd981c927ae723ca7b6","observation_id":"6c4bf908-fc58-4a68-9982-cacc22bfeced","resolution":{"observed_at":"2026-05-16T19:55:11.567825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2009 , url =","venue":null,"work_id":"f5f29353-b9d9-4d03-a219-74801374bc35","year":2009},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:d379dca3220e503249ce2fdb5f7dbb249a8b4d340289dc8686e4ffe35696e324","observation_id":"30935571-286c-487f-ae9e-434e130dd855","resolution":{"observed_at":"2026-05-16T19:55:11.570430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2021 , url =","venue":null,"work_id":"7692a956-1e61-4b48-9756-2db45197e6b9","year":2021},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:5831ffc05fb3ca8e95993a9bf2f97e7357c66dd5f3919f34ed19a8d507b20b39","observation_id":"906ef497-f730-4b5f-abef-dafeda698973","resolution":{"observed_at":"2026-05-16T19:55:11.572752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f9026051-0b16-4d28-ad8d-f272a464b429","year":1990},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:c72fd2f10ab089c1064e6732361a97a7d0bf7e33571ebade91e47e928e29a68a","observation_id":"f1854db5-f077-4c51-b91d-06b1ece70922","resolution":{"observed_at":"2026-05-16T19:55:11.575250Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scientific data , volume=","venue":null,"work_id":"2bb5bf94-1a18-4b81-99dc-4f98b75f0d16","year":2018},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:7b108178627118a489892e25acb6db7fb28b05981be57222b6e1bc072c4c6d5e","observation_id":"25102d07-167c-400d-a589-814d2c947867","resolution":{"observed_at":"2026-05-16T19:55:11.577484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2014 , publisher=","venue":null,"work_id":"138a5da7-e406-4f10-92f1-d27f737754e5","year":2014},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:a8ad6705ff3406af2290842f0e2de38848803bff9a3b98c89222d1fe4efb134f","observation_id":"0d55c713-1b4f-412e-b793-7981e7a90f4d","resolution":{"observed_at":"2026-05-16T19:55:11.579656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.acl-long.132","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning from the Worst: Dynamically Generated Datasets to Improve Online Hate Detection","venue":null,"work_id":"29b16777-7d4f-41d3-8291-14218ebd2d74","year":2021},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:94d189dfe4b73414cb4f1865af78d0f92f9c0bd37b15ca218e9f86b2a0795902","observation_id":"f70b3ec5-a9f5-488d-adbc-aee7b60cf756","resolution":{"observed_at":"2026-05-16T19:55:11.478889Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-22T10:23:54.203401+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T10:23:54.203401+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.emnlp-main.157","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Detecting Independent Pronoun Bias with Partially-Synthetic Data Generation","venue":null,"work_id":"8afd9bce-6007-4abd-ace7-5a48c73cf24f","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:cc314e9a80b70bd3fcbc2fb3dff5d6e85e2d29303705cde4cd515072807a89c5","observation_id":"c15b66eb-d5ae-4920-908b-cadde0a872ae","resolution":{"observed_at":"2026-05-16T19:55:11.482555Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.acl-long.81","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"acl-main.485/","venue":null,"work_id":"65eda38c-99bc-43dd-b298-7079b3e48402","year":2021},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:d8444f809a2cd3ab8d3995dfa70cc46d4170e7422680a9c1a26be29c9892aec3","observation_id":"64df7697-24d8-4397-91c3-f52763e45198","resolution":{"observed_at":"2026-05-16T19:55:11.485382Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-19T15:22:07.001624+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-19T15:22:07.001624+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d17-1082","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/D17-1082","venue":null,"work_id":"4e65f57b-0562-4172-b6d3-b4ea2e5e62fb","year":2017},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:84d6322b822423d606eb478dec300acd3cd8b345b7a576c27b4fdcd1437383c2","observation_id":"ef42b94d-28e8-4fb3-8751-1d0eadeb5daf","resolution":{"observed_at":"2026-05-16T19:55:11.488387Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-13T23:49:40.495585+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T23:49:40.495585+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T07:10:46.912230Z","title":"Think you have solved question answering?","venue":null,"work_id":"b1c21461-50ed-464b-9bb5-82e77833ae85","year":2018},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:871e89ddbb907749713ad048332bd6e83fc4eeccbfde8419e6b9e958fab82a03","observation_id":"31d7b79b-922b-40b3-bba1-a5e795bec0a9","resolution":{"observed_at":"2026-05-16T19:55:11.581997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2020 , url=","venue":null,"work_id":"0054b696-3a61-4188-9989-2ef52b8786b2","year":2020},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:2793f106e3fcc867fcda7cf34cb2b97e4323c821d19a529a3b0e8e4856bb0fdc","observation_id":"b09541f1-694c-4594-af40-34dc41b3142a","resolution":{"observed_at":"2026-05-16T19:55:11.584330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2021 , url=","venue":null,"work_id":"31fa4c93-9eea-45a5-b16f-02764a0ad156","year":2021},"citing_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-16T19:55:11.431020Z"},"links":{"citing_paper":"/paper/2110.08193"},"observation_digest":"sha256:d65df29d74df0938fef0623533a41b1044d76a70ba3c6caa870defc2dfdbf5bc","observation_id":"235ab9a6-71f1-4ae3-ad18-ce96db4faff6","resolution":{"observed_at":"2026-05-16T19:55:11.588471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":17,"verified_exact":20,"verified_fuzzy":23},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 39 inbound Pith citation observations for arXiv:2110.08193."}