{"as_of":"2026-08-11T21:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dea8f151059bf5f542d5846c5b5ad59b932aa5d116292eeeac582b1e52abb76b","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T23:08:45.205423Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.21052/citation-record","integrity":"/paper/2412.21052/integrity","json":"/paper/2412.21052/citation-record.json","paper":"/paper/2412.21052"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.007612Z","title":"What is your least favourite thing about GROUP people?","venue":null,"work_id":"399412f6-b577-4410-9ea3-a74b442ab865","year":2022},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:45.116237Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:272a31fd48f15011b544eec1d09f6a7aafaa1b3b7f03cd44f6928d79d82f9d67","observation_id":"31c91f13-db56-4c29-84dc-70653bbb41e1","resolution":{"observed_at":"2026-08-10T23:08:46.013570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.02145","last_updated":"2021-10-15T19:10:43Z","snapshot_observed_at":"2026-08-11T04:16:49.482079Z","submitted_at":"2021-04-05T20:36:11Z","title":"What Will it Take to Fix Benchmarking in Natural Language Understanding?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.02145","snapshot_observed_at":"2026-08-10T23:08:44.109938Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.109938Z"},"links":{"cited_paper":"/paper/2104.02145","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:4d9fa3bc0f0e13adaea823f1a348ec05d02fbc0079b7c55bb6fa5747e6fd6cc6","observation_id":"c93d6f05-293f-4694-83ec-c08040ca669e","resolution":{"observed_at":"2026-08-10T23:08:44.109938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.923666Z","title":"Cfpb circular 2022-03: Adverse action notification requirements in connection with credit decisions based on complex algorithms,","venue":null,"work_id":"c69106d2-a4d7-4575-9dac-efacc1a520c8","year":2022},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.115394Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:f00e292c1ab2b802db7d38639c0d180735d85587805180586f0dc30f37c8ffeb","observation_id":"b4d9e0b9-d556-4411-97e0-8b7c9a55261e","resolution":{"observed_at":"2026-08-10T23:08:46.931092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.892236Z","title":"DALL-EV AL: Probing the Reasoning Skills and Social Biases of Text-to-Image Generation Models","venue":null,"work_id":"db735881-27df-4179-ab6a-ab5e5c79f231","year":2023},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.245531Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:fdd4a99d56c35ad23237c6bc3e28384872e693ad848a5c981c59772541721240","observation_id":"6dd68368-0ee1-4446-8ed1-99765f8fdeee","resolution":{"observed_at":"2026-08-10T23:08:46.910718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-10T23:08:44.353142Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.353142Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:1dc88df171de86097e42bebfd2643fd4d1ee023fb99a60c176cfa834da8b373f","observation_id":"53db85ff-e855-43f3-a989-068d695769e1","resolution":{"observed_at":"2026-08-10T23:08:44.353142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11562","last_updated":"2024-03-06T16:31:51Z","snapshot_observed_at":"2026-08-11T17:52:32.944424Z","submitted_at":"2023-01-27T06:52:04Z","title":"Arbitrariness and Social Prediction: The Confounding Role of Variance in Fair Classification","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11562","snapshot_observed_at":"2026-08-10T23:08:44.408470Z","title":"Cooper, Solon Barocas, Christopher De Sa, and Siddhartha Sen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.408470Z"},"links":{"cited_paper":"/paper/2301.11562","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:6c1eb4d6f273d45bf0ffdc5ae9062ef730d73c2bd064c0784de28807a71af5a0","observation_id":"26b7423a-7215-4fd5-8be5-013f01ca5e78","resolution":{"observed_at":"2026-08-10T23:08:44.408470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.745311Z","title":"Patton, Elsbeth Turcan, and Kathleen McKeown","venue":null,"work_id":"1d738ee0-6e38-403b-b964-ad53def8fc73","year":2023},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.418503Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:c527cd4fb449fa73192b9a16a9879b2dfdeca114f8a4dfc06da3084a4bf20cab","observation_id":"506a2e4e-e9c5-4075-9c07-4ae498c6edd3","resolution":{"observed_at":"2026-08-10T23:08:46.804690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.727163Z","title":"Directive 2000/43/ec implementing the principle of equal treatment between persons irrespective of racial or ethnic origin,","venue":null,"work_id":"8303dcfc-e816-42cc-9330-1b8cc38ce0cb","year":2000},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.424588Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:53541639e41dd6a9414f9c640f8ca6af901230cabdffca98f5356f5053c02ad9","observation_id":"0f4e0725-a4d3-453b-955f-87ed3bce7ba9","resolution":{"observed_at":"2026-08-10T23:08:46.733477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T23:08:44.562466Z","title":"ZOLLO , N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.562466Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:1bde54d9f7bb905423d4fe56eb867d9c4a67b889f8d069fdda2d9be919ce8753","observation_id":"4678ae47-3298-4fb4-b851-1bb2bcbcb161","resolution":{"observed_at":"2026-08-10T23:08:44.562466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.579780Z","title":"On the impact of machine learning randomness on group fairness","venue":null,"work_id":"579139b7-dfed-4eb7-8a29-d84b7945341c","year":2023},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.683567Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:f967aece6c99d9852fa1747d0ed6cd3230ebbdb0b5720a27a47f195ef824fad1","observation_id":"ba2e434e-2397-4428-b00a-249cd359bb95","resolution":{"observed_at":"2026-08-10T23:08:46.597351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-10T23:08:44.690397Z","title":"Red teaming language models to reduce harms: Methods, scaling behaviors, and lessons learned","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.690397Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:209974ef2e6933591fbe49a1d41bb9df6052ac007527d904f7ac2f3218b9ed4e","observation_id":"5ca07260-3a52-4c7b-818d-04f9dcae9dc0","resolution":{"observed_at":"2026-08-10T23:08:44.690397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.496394Z","title":"Chatgpt perpetuates gender bias in machine translation and ignores non-gendered pronouns: Findings across bengali and five other low-resource languages","venue":null,"work_id":"ccf6137c-844e-482c-82e4-6907cba31b86","year":2023},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.696870Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:1674eb75e0f40a68f8943bdc46e8f2fa35b4c5b4a66b7bfdef5a2e3318f0d0a1","observation_id":"987067d8-efb7-4e4d-8a0c-0b221843428b","resolution":{"observed_at":"2026-08-10T23:08:46.502506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.439438Z","title":"Operationalizing the search for less discriminatory alternatives in fair lending","venue":null,"work_id":"e7a20abe-3381-48f2-98d3-6829eceeb4fa","year":2024},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.706404Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:b5d982db603c4c685305abbc4e21c3db706aac2d9021238e5d0e68044cda2962","observation_id":"cf6df869-a036-451f-8d9c-895131e8ebf6","resolution":{"observed_at":"2026-08-10T23:08:46.483653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14875","last_updated":"2025-01-24T01:15:16Z","snapshot_observed_at":"2026-08-09T22:46:40.798956Z","submitted_at":"2024-02-21T18:25:25Z","title":"What's in a Name? Auditing Large Language Models for Race and Gender Bias","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14875","snapshot_observed_at":"2026-08-10T23:08:44.794018Z","title":"What’s in a name? auditing large language models for race and gender bias","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.794018Z"},"links":{"cited_paper":"/paper/2402.14875","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:eb6e4deb74149e667b7412f69f86a7e2603da2f056a9ea71273e89f6f3168410","observation_id":"b06a2f11-c15f-4649-886d-57b2b22caade","resolution":{"observed_at":"2026-08-10T23:08:44.794018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11654","last_updated":"2024-06-17T15:36:14Z","snapshot_observed_at":"2026-07-06T18:32:15.404516Z","submitted_at":"2024-06-17T15:36:14Z","title":"Ruby Teaming: Improving Quality Diversity Search with Memory for Automated Red Teaming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11654","snapshot_observed_at":"2026-08-10T23:08:44.840047Z","title":"ZOLLO , N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.840047Z"},"links":{"cited_paper":"/paper/2406.11654","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:984d2819be752f7a05eb07214a74251c64e0faa41551292b646e0e3f4a677b01","observation_id":"efee1d72-06e8-46be-9fbe-90126027717d","resolution":{"observed_at":"2026-08-10T23:08:44.840047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01586","last_updated":"2024-10-03T22:12:05Z","snapshot_observed_at":"2026-08-10T19:59:53.547509Z","submitted_at":"2024-02-02T17:26:23Z","title":"TrustAgent: Towards Safe and Trustworthy LLM-based Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01586","snapshot_observed_at":"2026-08-10T23:08:44.868696Z","title":"Trusta- gent: Towards safe and trustworthy llm-based agents through agent constitution.arXiv:2402.01586,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.868696Z"},"links":{"cited_paper":"/paper/2402.01586","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:30c4e724633636c239bfca97e6a6cc7e7959654d6ace9e26df0b209e1967fe58","observation_id":"35f4f9b4-3aa7-4454-a51f-4493b6c3b9bf","resolution":{"observed_at":"2026-08-10T23:08:44.868696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03876","last_updated":"2024-12-21T11:24:01Z","snapshot_observed_at":"2026-08-11T17:13:49.500403Z","submitted_at":"2024-07-04T12:14:27Z","title":"Automated Progressive Red Teaming","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03876","snapshot_observed_at":"2026-08-10T23:08:44.875046Z","title":"Dart: Deep adversarial automated red teaming for llm safety","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.875046Z"},"links":{"cited_paper":"/paper/2407.03876","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:5fe288cdebadb98b2cfe9682045d335e81ba7ba41ffd6c0acbc7d1434ae69ec3","observation_id":"f9343a61-7c0a-4a5f-a6b4-f2a0062b5050","resolution":{"observed_at":"2026-08-10T23:08:44.875046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13787","last_updated":"2024-06-08T16:40:12Z","snapshot_observed_at":"2026-08-02T18:11:57.036767Z","submitted_at":"2024-03-20T17:49:54Z","title":"RewardBench: Evaluating Reward Models for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13787","snapshot_observed_at":"2026-08-10T23:08:44.881213Z","title":"Smith, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.881213Z"},"links":{"cited_paper":"/paper/2403.13787","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:c18f656b4f70b382e916707effbe0912d5ea57b236b94d9a19a436e8821b6e38","observation_id":"c23a4b30-bca6-477a-984f-e73f601c26bd","resolution":{"observed_at":"2026-08-10T23:08:44.881213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12649","last_updated":"2025-06-05T14:35:00Z","snapshot_observed_at":"2026-08-10T05:02:44.908638Z","submitted_at":"2024-02-20T01:49:15Z","title":"Bias in Language Models: Beyond Trick Tests and Toward RUTEd Evaluation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12649","snapshot_observed_at":"2026-08-10T23:08:44.908977Z","title":"Bias in language models: Beyond trick tests and toward ruted evaluation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.908977Z"},"links":{"cited_paper":"/paper/2402.12649","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:e1919522850e3c12b8ef877e91876897240298b29a18e51b6deba2294fa22f60","observation_id":"c7658f5f-b9a9-4386-803c-169039fbba94","resolution":{"observed_at":"2026-08-10T23:08:44.908977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.336596Z","title":"Zemel, Kai-Wei Chang, Aram Galstyan, and Rahul Gupta","venue":null,"work_id":"88d0674f-e47b-480b-886b-2fddda6cc356","year":2024},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.958343Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:e3464322710cc0f8b0e69f33f94c638bac944211e515329194019901b3314f30","observation_id":"6093cf5d-27df-4080-ad14-8accbbd31cab","resolution":{"observed_at":"2026-08-10T23:08:46.375669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T23:08:44.980102Z","title":"ZOLLO , N","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.980102Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:b9cfb74bb9cb1bc5368822e0892232f165d758d6fe4955f0df66fb5a4d28e8ea","observation_id":"1b344f11-9f7e-4c13-93af-79af775b229c","resolution":{"observed_at":"2026-08-10T23:08:44.980102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.280879Z","title":"Red teaming language models with language models","venue":null,"work_id":"91fe1605-fd6d-412e-be62-13804a935f99","year":2022},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.987631Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:573f587fbf54537830931e5c7799720d1b8821507a0dd4da78c084f77ef6b4f7","observation_id":"53eb0d49-5da6-4535-904b-5ace80f5eb79","resolution":{"observed_at":"2026-08-10T23:08:46.287151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.162497Z","title":"ZOLLO , N","venue":null,"work_id":"cd7f3db1-c6e5-499e-bd60-36459fef0753","year":2024},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:45.000927Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:666da9ad8146cc292fb4bad469ba9cbdffa760d7e9a3524c511a7dc5750edf70","observation_id":"aabfd4c0-59e7-463a-9b0e-e41b0a95a90e","resolution":{"observed_at":"2026-08-10T23:08:46.168380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.15366","last_updated":"2021-11-26T19:39:34Z","snapshot_observed_at":"2026-08-07T00:21:07.584753Z","submitted_at":"2021-11-26T19:39:34Z","title":"AI and the Everything in the Whole Wide World Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.15366","snapshot_observed_at":"2026-08-10T23:08:45.007232Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:45.007232Z"},"links":{"cited_paper":"/paper/2111.15366","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:c25d0ac5f31b81587356a432816a241cec08fdd95b39aad41ecc0f94a3544759","observation_id":"4d013b7b-4243-4dd8-ab73-5baa13f66d23","resolution":{"observed_at":"2026-08-10T23:08:45.007232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20371","last_updated":"2024-08-20T21:49:26Z","snapshot_observed_at":"2026-07-06T18:53:35.627045Z","submitted_at":"2024-07-29T18:42:39Z","title":"Gender, Race, and Intersectional Bias in Resume Screening via Language Model Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20371","snapshot_observed_at":"2026-08-10T23:08:45.013758Z","title":"Executive order 14110: Advancing american leadership in artificial intelligence, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:45.013758Z"},"links":{"cited_paper":"/paper/2407.20371","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:f459fcdbe65d56bc03d6d9f39cb97638860fe1d8f35dcabb7ef688b65fbdcf63","observation_id":"b56f97a4-27ab-4319-b62b-025adf577f81","resolution":{"observed_at":"2026-08-10T23:08:45.013758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03025","last_updated":"2023-11-12T06:25:32Z","snapshot_observed_at":"2026-08-11T20:46:25.814042Z","submitted_at":"2023-07-06T14:42:01Z","title":"Style Over Substance: Evaluation Biases for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03025","snapshot_observed_at":"2026-08-10T23:08:45.056396Z","title":"Style over substance: Evaluation biases for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:45.056396Z"},"links":{"cited_paper":"/paper/2307.03025","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:805ac104cec02e34492c889b498386ae6ee280103dcca983799896a8b3b0b013","observation_id":"e2f0eef1-7b78-4339-a36a-499e667d4121","resolution":{"observed_at":"2026-08-10T23:08:45.056396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02726","last_updated":"2024-03-05T07:34:41Z","snapshot_observed_at":"2026-08-08T18:03:38.031068Z","submitted_at":"2024-03-05T07:34:41Z","title":"Bias in Generative AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02726","snapshot_observed_at":"2026-08-10T23:08:45.093035Z","title":"Bias in generative ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:45.093035Z"},"links":{"cited_paper":"/paper/2403.02726","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:9d77f570e0763a17f5c2a98b6a5c7a35e3878cead9919ad842107b1bf6c112a2","observation_id":"da8fea35-815f-4301-8020-157607afa73f","resolution":{"observed_at":"2026-08-10T23:08:45.093035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20296","last_updated":"2025-02-24T16:00:16Z","snapshot_observed_at":"2026-08-09T22:08:37.100554Z","submitted_at":"2024-09-30T13:55:42Z","title":"PersonalLLM: Tailoring LLMs to Individual Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20296","snapshot_observed_at":"2026-08-10T23:08:45.099665Z","title":"Zollo, Andrew Wei Tung Siah, Naimeng Ye, Ang Li, and Hongseok Namkoong","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:45.099665Z"},"links":{"cited_paper":"/paper/2409.20296","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:c57cbc181d82df8ab45da0292a2c6d9d91e532ec551c09fdde0fe892a034b659","observation_id":"ecb24f40-f36e-4719-b049-5fd1a8aff5c1","resolution":{"observed_at":"2026-08-10T23:08:45.099665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:45.988983Z","title":"To compute toxicity, we use the Detoxify model Hanu and Unitary team (2020)","venue":null,"work_id":"120e4646-8dcf-4468-bb14-d2fb48babe3a","year":2020},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:45.121973Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:a806a5950060b917ef30e8c0aad2728a46e75c81d0ae548dfb84b26aa8edb953","observation_id":"0e581f22-6566-4b66-988b-03662e1ab684","resolution":{"observed_at":"2026-08-10T23:08:45.995232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:45.947831Z","title":"ZOLLO , N","venue":null,"work_id":"afc2ea99-ed1c-45a7-8495-a6fdff548c4a","year":2021},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:45.205423Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:ffc37c5588dc52c6acddb4db674e8aecab0aefc100c9d5f98d41f2d4e081f845","observation_id":"44a97102-141b-4a2d-a53a-f922111f197f","resolution":{"observed_at":"2026-08-10T23:08:45.976276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.132739Z","title":"Appendix B","venue":null,"work_id":"c75c19a9-bfb3-431c-8274-b8c544439ccf","year":2024},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":144,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:45.106834Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:ef082c409039f6205b1547766ade475743998711f28d86c6426f4d8e9f1e42b5","observation_id":"26809750-fcce-49b9-9673-0a1ae94a4fec","resolution":{"observed_at":"2026-08-10T23:08:46.149621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03086","last_updated":"2024-04-03T22:01:26Z","snapshot_observed_at":"2026-08-10T07:33:16.248166Z","submitted_at":"2024-04-03T22:01:26Z","title":"Auditing the Use of Language Models to Guide Hiring Decisions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03086","snapshot_observed_at":"2026-08-10T23:08:44.673837Z","title":"Gaebler, Sharad Goel, Aziz Huq, and Prasanna Tambe","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":1968,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.673837Z"},"links":{"cited_paper":"/paper/2404.03086","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:08c1dab41a1d053e41d26e918dfd6204ada96e5e08799465276806696614c10c","observation_id":"d0c3ac21-48c2-4cef-8e38-02af4c7b047d","resolution":{"observed_at":"2026-08-10T23:08:44.673837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.639243Z","title":"Directive 2006/54/ec on the implementation of the principle of equal opportunities and equal treatment of men and women in matters of employment and occupation (recast),","venue":null,"work_id":"a645534b-86f2-4f96-8c6f-df902154ead8","year":2006},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.430384Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:8d2fcf4f84ac1ae830bc26ca9dc34780288c06874773f60566308535a781fcd9","observation_id":"696753ce-5899-4818-b339-960a317b456c","resolution":{"observed_at":"2026-08-10T23:08:46.688609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:47.140868Z","title":"Easily accessible text-to- image generation amplifies demographic stereotypes at large scale","venue":null,"work_id":"ac702d18-9c21-4907-a1dc-4f2a4d91813b","year":2023},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":2003,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.089089Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:26df324f857e9b6368e065574f9cee970c92943da224b1c80b264af99d2db596","observation_id":"29980607-0d8d-4f77-9b28-a3a3fcef0267","resolution":{"observed_at":"2026-08-10T23:08:47.249516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.388070Z","title":"Toxicchat: Unveiling hidden challenges of toxicity detection in real-world user-ai conversation","venue":null,"work_id":"eaeb15a4-345b-4903-8a75-894a24e9e563","year":2023},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.887215Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:3aec3bf4869ee2cc71e8cb05f4e551b66a588d1295ea2bbd23efb3afc777e43a","observation_id":"e842c87d-1d20-477e-b31a-940af98aec17","resolution":{"observed_at":"2026-08-10T23:08:46.394576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.608994Z","title":"Directive 2000/78/ec establishing a general framework for equal treatment in employment and occupation,","venue":null,"work_id":"b1bf696f-9615-4dc4-acf0-dcec59ca3af5","year":2000},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.456276Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:6c216a389ad4fca28f74d51cda98ee995b9081b7e3caf3d3ab3f9a2503d42c66","observation_id":"b40f2784-af29-4fbf-a6c9-6b976b92894d","resolution":{"observed_at":"2026-08-10T23:08:46.614791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:44.862387Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.862387Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:fc82d5efa312b397a9e1bd4bc7f4208b5af913ee509fe4312617d879291379e9","observation_id":"88516843-4c0e-48cf-99af-e9ad0cf645e4","resolution":{"observed_at":"2026-08-10T23:08:44.862387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10329","last_updated":"2024-06-26T13:32:58Z","snapshot_observed_at":"2026-07-06T18:46:09.997234Z","submitted_at":"2024-06-26T13:32:58Z","title":"Generative Discrimination: What Happens When Generative AI Exhibits Bias, and What Can Be Done About It","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10329","snapshot_observed_at":"2026-08-10T23:08:44.712997Z","title":"Generative discrimination: What happens when generative ai exhibits bias, and what can be done about it","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.712997Z"},"links":{"cited_paper":"/paper/2407.10329","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:d0bcda18de8df3054187ead3ed5b68caec1881a91e6163f15d897af4044dbabb","observation_id":"a0e8e9bb-beca-4ef8-9e44-9432956902da","resolution":{"observed_at":"2026-08-10T23:08:44.712997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:47.260895Z","title":"Bender, Timnit Gebru, Angelina McMillan-Major, and Shmargaret Shmitchell","venue":null,"work_id":"f8fb4374-4758-4825-80c2-31f83b590ce8","year":2021},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.078577Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:c1e7644aac71458348e9617535f426dc7c79bc8c8a2c1ce39c57e90d230874e2","observation_id":"f93312af-f1e7-403e-8806-ea7b28151be5","resolution":{"observed_at":"2026-08-10T23:08:47.267330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.182903Z","title":"Unsafe diffusion: On the generation of unsafe images and hateful memes from text-to-image models","venue":null,"work_id":"51abbe1c-35db-45b1-9137-fac98e11b2d9","year":2023},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.994488Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:834af118928ede7507a6229df8818cd4373f3a60c25ef84aa4f1f0e1d1969c5b","observation_id":"00e2ddb5-3d27-4472-8a64-62a4b5a27768","resolution":{"observed_at":"2026-08-10T23:08:46.249130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:46.998763Z","title":"ZOLLO , N","venue":null,"work_id":"69817115-bc9c-45d5-a9e6-046f9c2c2c5d","year":2024},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.103108Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:11426bede645a54d35e4ef3aff761a3c8ff0fcb3343328a196f750ab9ae94f9d","observation_id":"75fe4917-f4e1-4f47-8599-4e3b568a684a","resolution":{"observed_at":"2026-08-10T23:08:47.005740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03098","last_updated":"2024-05-06T01:23:07Z","snapshot_observed_at":"2026-07-06T18:10:08.416524Z","submitted_at":"2024-05-06T01:23:07Z","title":"FairMonitor: A Dual-framework for Detecting Stereotypes and Biases in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03098","snapshot_observed_at":"2026-08-10T23:08:43.991185Z","title":"Fairmonitor: A dual-framework for detecting stereotypes and biases in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:43.991185Z"},"links":{"cited_paper":"/paper/2405.03098","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:701fdd6465908edbcfbd9c6e21766f89d779b59603e0c66b5a4f99ac7777125f","observation_id":"6c642ce8-728d-4eac-98e1-d5e0aa782d9c","resolution":{"observed_at":"2026-08-10T23:08:43.991185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T23:08:47.021324Z","title":"Leave-one-out unfairness","venue":null,"work_id":"4af93780-3f37-4da1-b7c5-62114496151b","year":2021},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.096919Z"},"links":{"citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:fdf791d5a7b24f4d2b0bfd30b6af87173786da4326cb9cbd71ae6cedf4848bf0","observation_id":"483d865e-757d-4955-8958-dbeb0855287e","resolution":{"observed_at":"2026-08-10T23:08:47.028015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-10T23:08:44.040228Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T23:08:44.040228Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2412.21052"},"observation_digest":"sha256:240911a6dd40d995d4c1302b1a5002a8d7b70096183c45ae1dbcd7c47118a7a1","observation_id":"f37d80f9-d625-42cd-ae96-8c4f52ed40fa","resolution":{"observed_at":"2026-08-10T23:08:44.040228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.21052","last_updated":"2024-12-30T16:09:33Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T23:01:33.157630Z","submitted_at":"2024-12-30T16:09:33Z","title":"Towards Effective Discrimination Testing for Generative AI"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2412.21052."}