{"as_of":"2026-08-08T03:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b0dc90cd729528bbd79cae56e3ea464bbaac055fd5a72cbc3d37a697f21e397b","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:13:20.054591Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00253/citation-record","integrity":"/paper/2506.00253/integrity","json":"/paper/2506.00253/citation-record.json","paper":"/paper/2506.00253"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-04T15:34:23.322583Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-07T12:13:13.741659Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:13.741659Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:c044d075b1e20156057705e8da31f41a2faa552527ec89cf72fd28088111ae6b","observation_id":"584af120-bfe6-40c1-b645-8947fdc8da08","resolution":{"observed_at":"2026-08-07T12:13:13.741659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/0963721411434980","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:20.934629Z","title":"Apfelbaum, Michael I","venue":null,"work_id":"e843fb1a-c998-4390-a8d3-9deaa356d6b6","year":2012},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:13.794504Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:002f7ea602740dd10ca80181aa6ee30e75441a8464ec514f6ef838345650bcf1","observation_id":"6693e333-a4bc-4cd5-aab8-f4c3287e2506","resolution":{"observed_at":"2026-08-07T12:13:21.009857Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:13.852499Z","title":"Griffiths","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:13.852499Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:98ac402c985e5d3c38e2f3db5212d277c0409bb8dfe2cbc2e78045cca3c58ff9","observation_id":"6959ccea-181f-4160-a58e-67650f41031f","resolution":{"observed_at":"2026-08-07T12:13:13.852499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T12:13:13.935489Z","title":"Bowman, Zac Hatfield-Dodds, Ben Mann, Dario Amodei, Nicholas Joseph, Sam McCandlish, Tom Brown, and Jared Kaplan","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:13.935489Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:3ad21d46b7869b6543c1d5e00e9c604c7205be3a6bfe4197c9c05eb8837be181","observation_id":"79169ae5-5c3e-4610-9b62-d5849c130c93","resolution":{"observed_at":"2026-08-07T12:13:13.935489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08112","last_updated":"2025-11-11T01:13:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-14T17:47:09Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08112","snapshot_observed_at":"2026-08-07T12:13:14.003675Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:14.003675Z"},"links":{"cited_paper":"/paper/2303.08112","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:7113511bf996d92aa01c69f3a77068dcafa703ab8a68a57bdf8878188f24b4a8","observation_id":"dee7fa67-5010-44a5-a867-7fc4e4cf00ed","resolution":{"observed_at":"2026-08-07T12:13:14.003675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14082","last_updated":"2024-08-23T23:02:28Z","snapshot_observed_at":"2026-07-06T18:03:38.397804Z","submitted_at":"2024-04-22T11:01:51Z","title":"Mechanistic Interpretability for AI Safety -- A Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14082","snapshot_observed_at":"2026-08-07T12:13:14.094600Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:14.094600Z"},"links":{"cited_paper":"/paper/2404.14082","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:379fbcbed5677da6bf54481021da93da28ef2e5aa165f830c8b3eb3f70436903","observation_id":"25500e5a-d219-4d35-a161-615a1926a79d","resolution":{"observed_at":"2026-08-07T12:13:14.094600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:24.020796Z","title":null,"venue":null,"work_id":"eabe10cc-b6fa-467a-8b13-dc2ece886585","year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:14.161233Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:5c789af8ae780e6dd099296636ec90adcdc39264ec1bd33d68e1c68a55b526ff","observation_id":"b9021306-b3f1-4f09-a292-b7889ada3133","resolution":{"observed_at":"2026-08-07T12:13:24.122596Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:23.839111Z","title":null,"venue":null,"work_id":"2cbd7e62-b4a2-491a-83a7-e65d3d18cb55","year":2021},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:14.260481Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:03f6038298b82bf63e8b6f74865bbcaa0707f668c3703519ab19a747bd34a96a","observation_id":"ec3a1bb6-f211-4382-a1a5-f523cad9fb58","resolution":{"observed_at":"2026-08-07T12:13:23.955589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:14.350152Z","title":"Bryson, and Arvind Narayanan","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:14.350152Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:b4546bae439b3cdf0cef781d9da7d692851b453d73a2deeb1b2783acb3ba0056","observation_id":"b587f0b4-5934-44b7-83d5-8e94695885a6","resolution":{"observed_at":"2026-08-07T12:13:14.350152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10949","last_updated":"2024-03-26T01:15:09Z","snapshot_observed_at":"2026-07-06T17:45:43.726336Z","submitted_at":"2024-03-16T15:30:34Z","title":"SelfIE: Self-Interpretation of Large Language Model Embeddings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10949","snapshot_observed_at":"2026-08-07T12:13:14.424151Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:14.424151Z"},"links":{"cited_paper":"/paper/2403.10949","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:23bcb6dcbef9f1dd19d0da32448272370bf86bd9ca28f4d39f842c128c1d99c9","observation_id":"00cfff6c-03a5-4672-a484-d602f0ba15bd","resolution":{"observed_at":"2026-08-07T12:13:14.424151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:22.822753Z","title":null,"venue":null,"work_id":"771270ef-2617-4bec-a0ab-ae6f89c821ce","year":2021},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:14.501115Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:7aa22c6599ad6322253c88f3659545d8d20bd8749f2a2554e027e56c04e3e7ff","observation_id":"38c54000-6257-4f66-ab11-430cc0e4cb18","resolution":{"observed_at":"2026-08-07T12:13:22.867513Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13551","last_updated":"2024-06-19T13:38:34Z","snapshot_observed_at":"2026-08-04T11:51:07.825881Z","submitted_at":"2024-06-19T13:38:34Z","title":"Mitigating Social Biases in Language Models through Unlearning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13551","snapshot_observed_at":"2026-08-07T12:13:14.600807Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:14.600807Z"},"links":{"cited_paper":"/paper/2406.13551","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:8982edd48b13275e2c1018c3e75cd7538c23514d7f73b01312ccc8f2fad6191e","observation_id":"08e949fc-017d-46d7-a534-d69180fd89ee","resolution":{"observed_at":"2026-08-07T12:13:14.600807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.08608","last_updated":"2017-03-02T19:32:10Z","snapshot_observed_at":"2026-08-07T08:20:39.814613Z","submitted_at":"2017-02-28T02:19:20Z","title":"Towards A Rigorous Science of Interpretable Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.08608","snapshot_observed_at":"2026-08-07T12:13:14.667487Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:14.667487Z"},"links":{"cited_paper":"/paper/1702.08608","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:9827482b0865b039c6c9fe6c3c49d893c8544304f98b9e01e6769ee8c73050b3","observation_id":"b2146111-85f9-44e2-b22e-f2e110c592eb","resolution":{"observed_at":"2026-08-07T12:13:14.667487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1037/0022-3514.87.6.876","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:20.719972Z","title":"Eberhardt, Phillip Atiba Goff, Valerie J","venue":null,"work_id":"68b3d2cc-b458-4939-8953-ae327aae0e38","year":2004},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:14.750088Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:bffb00477e27e8f3328f51f438ed9094583011db508cc64165b26caaae6998fa","observation_id":"afe9ad33-06bc-464b-97c0-6a8a5d113ab8","resolution":{"observed_at":"2026-08-07T12:13:20.812539Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.02997","last_updated":"2021-10-27T00:41:24Z","snapshot_observed_at":"2026-07-06T11:16:19.955258Z","submitted_at":"2021-06-06T01:07:43Z","title":"Causal Abstractions of Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.02997","snapshot_observed_at":"2026-08-07T12:13:14.859364Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:14.859364Z"},"links":{"cited_paper":"/paper/2106.02997","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:a5b0b24a6abebf90c1459f2345b5545f4385b8c81e6dd4600b1dc1b6d6193183","observation_id":"58b48d5e-0cb3-401c-a28c-3804aefd0595","resolution":{"observed_at":"2026-08-07T12:13:14.859364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03042","last_updated":"2024-06-09T17:00:36Z","snapshot_observed_at":"2026-08-03T15:24:37.746408Z","submitted_at":"2023-07-06T15:06:41Z","title":"Parameter-Efficient Fine-Tuning of LLaMA for the Clinical Domain","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03042","snapshot_observed_at":"2026-08-07T12:13:15.219580Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:15.219580Z"},"links":{"cited_paper":"/paper/2307.03042","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:b96ec182a0ca424deaa1af9f2dd5fb032fbcbccbe072219422a3e44848d3ea91","observation_id":"78865775-a7b6-4d8b-a38d-51be5ae4aba3","resolution":{"observed_at":"2026-08-07T12:13:15.219580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14767","last_updated":"2023-10-13T19:01:20Z","snapshot_observed_at":"2026-08-08T01:23:06.292487Z","submitted_at":"2023-04-28T11:26:17Z","title":"Dissecting Recall of Factual Associations in Auto-Regressive Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14767","snapshot_observed_at":"2026-08-07T12:13:16.064697Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:16.064697Z"},"links":{"cited_paper":"/paper/2304.14767","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:6d5d66c0ccb238428d089f898212b3d738991d36522c568df06014718d64c0b3","observation_id":"4586dff6-61a8-4446-bff3-2bb97f195644","resolution":{"observed_at":"2026-08-07T12:13:16.064697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06102","last_updated":"2024-06-06T22:59:58Z","snapshot_observed_at":"2026-08-08T01:23:42.996552Z","submitted_at":"2024-01-11T18:33:48Z","title":"Patchscopes: A Unifying Framework for Inspecting Hidden Representations of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06102","snapshot_observed_at":"2026-08-07T12:13:16.597821Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:16.597821Z"},"links":{"cited_paper":"/paper/2401.06102","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:79e7d3492cbe342a6ecc43046243177bcf30b0651c82f7be3284a8155740afaf","observation_id":"df06e2fa-0b1f-4ae8-969c-f9f447510e4a","resolution":{"observed_at":"2026-08-07T12:13:16.597821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1037/amp0000238","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:20.606835Z","title":"Greenwald and Mahzarin R","venue":null,"work_id":"e6cf858e-0fe8-49c5-8af9-97e83fa25c13","year":2017},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:16.686678Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:9ee4975e149e90c87f28cade00062f1347114f59c520d558f690360302aa299f","observation_id":"ff1a6bf1-8d9a-4d56-a162-33a4b15fe7ab","resolution":{"observed_at":"2026-08-07T12:13:20.659024Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:16.789954Z","title":"Greenwald, Debbie E","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:16.789954Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:4c8c28b846bbed7381db059ba6d95e83347988f75ebd46b51fc8fbe5135ab68b","observation_id":"35e296b4-9900-4eca-ad87-17e749474d98","resolution":{"observed_at":"2026-08-07T12:13:16.789954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04700","last_updated":"2024-10-04T20:02:33Z","snapshot_observed_at":"2026-07-06T17:13:25.341853Z","submitted_at":"2024-01-09T18:03:15Z","title":"Model Editing Harms General Abilities of Large Language Models: Regularization to the Rescue","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04700","snapshot_observed_at":"2026-08-07T12:13:16.945425Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:16.945425Z"},"links":{"cited_paper":"/paper/2401.04700","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:f973560c151a3301d4aa216750b1992a9ec785333525648a4b667cac997e1af4","observation_id":"224ed99f-e562-4cb1-b849-0c55c27b0dff","resolution":{"observed_at":"2026-08-07T12:13:16.945425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02207","last_updated":"2024-03-04T18:25:29Z","snapshot_observed_at":"2026-08-06T19:42:39.893943Z","submitted_at":"2023-10-03T17:06:52Z","title":"Language Models Represent Space and Time","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02207","snapshot_observed_at":"2026-08-07T12:13:17.067308Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.067308Z"},"links":{"cited_paper":"/paper/2310.02207","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:e30d5655fdb950966a9c7e9a52e3b040765d9d73e0ce743a62ac623ca5a13313","observation_id":"d49ceaf5-1daa-4fd0-a90d-dba6ef10d58f","resolution":{"observed_at":"2026-08-07T12:13:17.067308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.00586","last_updated":"2023-11-02T10:55:18Z","snapshot_observed_at":"2026-07-06T15:21:42.630985Z","submitted_at":"2023-04-30T21:44:21Z","title":"How does GPT-2 compute greater-than?: Interpreting mathematical abilities in a pre-trained language model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.00586","snapshot_observed_at":"2026-08-07T12:13:17.160012Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.160012Z"},"links":{"cited_paper":"/paper/2305.00586","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:6703c4c4eaaba078f914c361e39df65a15341f017f936f23e470962f76614e29","observation_id":"b85fd806-9985-45e6-81e9-159e2ab2f9e0","resolution":{"observed_at":"2026-08-07T12:13:17.160012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15255","last_updated":"2024-04-23T17:42:29Z","snapshot_observed_at":"2026-07-31T21:25:53.647335Z","submitted_at":"2024-04-23T17:42:29Z","title":"How to use and interpret activation patching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15255","snapshot_observed_at":"2026-08-07T12:13:17.249944Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.249944Z"},"links":{"cited_paper":"/paper/2404.15255","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:87bf7a32d66a1bf0e8bf36c8534669206bacc8aeeb6c2fac07e72ba4a59ac0b5","observation_id":"d2637206-1289-405a-96cc-507c0d022e51","resolution":{"observed_at":"2026-08-07T12:13:17.249944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-024-07037-z","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:20.484603Z","title":null,"venue":null,"work_id":"1975322d-c233-4f10-bdca-8e9ed172567c","year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.354469Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:9072a5de80b6f1a62bcd6a7f3a3069a4bd04320a3b510555bd24fed431619c77","observation_id":"b4570df3-89e4-456c-a36b-1130f1215455","resolution":{"observed_at":"2026-08-07T12:13:20.549384Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00189","last_updated":"2023-07-31T22:58:41Z","snapshot_observed_at":"2026-08-07T23:46:27.720985Z","submitted_at":"2023-07-31T22:58:41Z","title":"Generative Models as a Complex Systems Science: How can we make sense of large language model behavior?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00189","snapshot_observed_at":"2026-08-07T12:13:17.479369Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.479369Z"},"links":{"cited_paper":"/paper/2308.00189","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:54ccef4f720f89581acb90d72f606454b75cedc85cdda9449171260f7ef16681","observation_id":"3acbc310-04b9-4d3a-8ac8-f5ef511f3555","resolution":{"observed_at":"2026-08-07T12:13:17.479369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T12:13:17.522209Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.522209Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:341055b1214de24d09d007cf914cee07101aa81459793dcc545742c75048816c","observation_id":"480c2b11-832e-45c7-b6fd-5f6b41f0b59d","resolution":{"observed_at":"2026-08-07T12:13:17.522209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02418","last_updated":"2024-07-29T20:29:32Z","snapshot_observed_at":"2026-07-06T17:54:55.305530Z","submitted_at":"2024-04-03T02:56:52Z","title":"Auxiliary task demands mask the capabilities of smaller language models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02418","snapshot_observed_at":"2026-08-07T12:13:17.581753Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.581753Z"},"links":{"cited_paper":"/paper/2404.02418","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:f9c341c55218c198ad7a5fc2b99272282e7d557f0a42da97835d0b0513ccc105","observation_id":"243aac18-e9b7-4429-92a4-baab3b8899e9","resolution":{"observed_at":"2026-08-07T12:13:17.581753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.11279","last_updated":"2018-06-07T04:33:27Z","snapshot_observed_at":"2026-08-04T20:10:18.590341Z","submitted_at":"2017-11-30T09:26:12Z","title":"Interpretability Beyond Feature Attribution: Quantitative Testing with Concept Activation Vectors (TCAV)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.11279","snapshot_observed_at":"2026-08-07T12:13:17.616483Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.616483Z"},"links":{"cited_paper":"/paper/1711.11279","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:bae1a4f6e4184d05edafdb39430545476f928753fdc0ed43987c4ce01a4bbdd9","observation_id":"37a768e2-1405-43ac-9b6f-612938c3823b","resolution":{"observed_at":"2026-08-07T12:13:17.616483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12864","last_updated":"2024-10-13T03:43:18Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-13T03:43:18Z","title":"Investigating Implicit Bias in Large Language Models: A Large-Scale Study of Over 50 LLMs","version":1},"cited_work":{"arxiv_id":"2410.12864","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.12864","snapshot_observed_at":"2026-08-07T12:13:22.431154Z","title":"Investigating Implicit Bias in Large Language Models: A Large-Scale Study of Over 50 LLMs","venue":"cs.CL","work_id":"544b34df-ca00-4e02-b549-15b6402b9a76","year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.673015Z"},"links":{"cited_paper":"/paper/2410.12864","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:767232bfdf209d3430e23d8dda9e310573bce02dc6ddfce87de3f31c03de2e3e","observation_id":"334c5b38-8c20-4ff2-9902-768826231db7","resolution":{"observed_at":"2026-08-07T12:13:22.496299Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01967","last_updated":"2024-01-03T20:26:15Z","snapshot_observed_at":"2026-08-06T16:33:15.793419Z","submitted_at":"2024-01-03T20:26:15Z","title":"A Mechanistic Understanding of Alignment Algorithms: A Case Study on DPO and Toxicity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01967","snapshot_observed_at":"2026-08-07T12:13:17.735447Z","title":"Kummerfeld, and Rada Mihalcea","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.735447Z"},"links":{"cited_paper":"/paper/2401.01967","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:95762c08b86355b7ec8dde119bd269403060974218fef9d0b5db56c025d68f8b","observation_id":"e8c1a24c-31d4-49f9-8c43-df6bbe522c10","resolution":{"observed_at":"2026-08-07T12:13:17.735447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:23.700656Z","title":"Levinson, Huajian Cai, and Danielle Young","venue":null,"work_id":"bb96e68f-6c13-41c6-84e9-1bde11c87837","year":2009},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.789820Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:f7890698798ca8002a038ab5ddb4fc41084dee3078f529c7b30d5acfbdd139e5","observation_id":"c8fc1369-dbc1-4c58-9090-afafa544b429","resolution":{"observed_at":"2026-08-07T12:13:23.767619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03341","last_updated":"2024-06-26T14:11:53Z","snapshot_observed_at":"2026-07-06T15:38:58.578200Z","submitted_at":"2023-06-06T01:26:53Z","title":"Inference-Time Intervention: Eliciting Truthful Answers from a Language Model","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03341","snapshot_observed_at":"2026-08-07T12:13:17.840290Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.840290Z"},"links":{"cited_paper":"/paper/2306.03341","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:cfae886a56ff0a0710eaa76ade22f3c1f539e06f6bcbfc8c2aa37d36fca6a346","observation_id":"66717e8c-5316-418f-89fe-dd5ecaf976b1","resolution":{"observed_at":"2026-08-07T12:13:17.840290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06824","last_updated":"2025-02-21T05:17:52Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-12T00:50:04Z","title":"Revisiting Jailbreaking for Large Language Models: A Representation Engineering Perspective","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06824","snapshot_observed_at":"2026-08-07T12:13:17.876984Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.876984Z"},"links":{"cited_paper":"/paper/2401.06824","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:0214c98f17c37982be106eec9c50dd4a92bcb2a399e2bdd0664f988337cc8b2d","observation_id":"a41f2c33-8fd2-409f-bcd0-ee0654ea817c","resolution":{"observed_at":"2026-08-07T12:13:17.876984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01208","last_updated":"2023-10-02T13:53:03Z","snapshot_observed_at":"2026-07-06T16:26:30.291083Z","submitted_at":"2023-10-02T13:53:03Z","title":"Label Supervised LLaMA Finetuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01208","snapshot_observed_at":"2026-08-07T12:13:17.913243Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.913243Z"},"links":{"cited_paper":"/paper/2310.01208","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:7a47dfed65eda9bda6b9cecdc307bd4f9a515c04e429eb60167a9c703ec4bae1","observation_id":"2a9d59b5-2f6e-49be-a7f3-b9a841bab127","resolution":{"observed_at":"2026-08-07T12:13:17.913243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09458","last_updated":"2023-07-24T08:32:40Z","snapshot_observed_at":"2026-07-06T15:55:28.974661Z","submitted_at":"2023-07-18T17:39:04Z","title":"Does Circuit Analysis Interpretability Scale? Evidence from Multiple Choice Capabilities in Chinchilla","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09458","snapshot_observed_at":"2026-08-07T12:13:17.953463Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.953463Z"},"links":{"cited_paper":"/paper/2307.09458","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:98d74926772ef4024f6c1992d83376bc67e95cea5c9cd7eab878ffda165cd14f","observation_id":"862d51d8-9230-4423-a187-bc9d42e4369f","resolution":{"observed_at":"2026-08-07T12:13:17.953463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11005","last_updated":"2025-06-09T11:20:58Z","snapshot_observed_at":"2026-08-06T12:02:27.018661Z","submitted_at":"2024-10-14T18:44:23Z","title":"Assessing Dialect Fairness and Robustness of Large Language Models in Reasoning Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11005","snapshot_observed_at":"2026-08-07T12:13:17.999979Z","title":"Pierrehumbert, and Furu Wei","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:17.999979Z"},"links":{"cited_paper":"/paper/2410.11005","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:76a60130cc4f5508fcfc7152a828e1d4c941a68d3d95a871a4dc2da7156e634b","observation_id":"2a1acba3-eaf7-4cb5-be78-f6d35f2f4183","resolution":{"observed_at":"2026-08-07T12:13:17.999979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.13586","last_updated":"2021-07-28T18:09:46Z","snapshot_observed_at":"2026-07-06T11:33:25.933445Z","submitted_at":"2021-07-28T18:09:46Z","title":"Pre-train, Prompt, and Predict: A Systematic Survey of Prompting Methods in Natural Language Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.13586","snapshot_observed_at":"2026-08-07T12:13:18.050267Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.050267Z"},"links":{"cited_paper":"/paper/2107.13586","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:fe3a80afd17ccf84bd219045a1d3d3aa7acef99f53f0b28a9765dd1ad851fd54","observation_id":"1e5db672-887f-4e75-befc-cd4d69882a92","resolution":{"observed_at":"2026-08-07T12:13:18.050267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:13:18.104681Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.104681Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:4d16138030c06585e1a1be57333f764111fbe999807234603c08d80a5350df99","observation_id":"e298aa2c-a53b-4891-9675-da7ad6e89c15","resolution":{"observed_at":"2026-08-07T12:13:18.104681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19647","last_updated":"2025-03-27T05:44:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-28T17:56:07Z","title":"Sparse Feature Circuits: Discovering and Editing Interpretable Causal Graphs in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19647","snapshot_observed_at":"2026-08-07T12:13:18.154269Z","title":"Michaud, Yonatan Belinkov, David Bau, and Aaron Mueller","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.154269Z"},"links":{"cited_paper":"/paper/2403.19647","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:2e383108be62bfdc92bd1bd8dc0c931786fde8f316a4b61c90e0f2b1338ad9c1","observation_id":"4a7b237b-bf63-47e0-ad39-b82784fff478","resolution":{"observed_at":"2026-08-07T12:13:18.154269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.05262","last_updated":"2023-01-13T15:16:16Z","snapshot_observed_at":"2026-07-06T12:36:34.388460Z","submitted_at":"2022-02-10T18:59:54Z","title":"Locating and Editing Factual Associations in GPT","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.05262","snapshot_observed_at":"2026-08-07T12:13:18.187628Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.187628Z"},"links":{"cited_paper":"/paper/2202.05262","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:da0aa2da9e5818cdd74afbcb44e6de61dc85215a041a7c97424ac85654a22d7c","observation_id":"147bb845-edff-422e-92ce-19d5829b3ec8","resolution":{"observed_at":"2026-08-07T12:13:18.187628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19827","last_updated":"2025-06-24T21:39:54Z","snapshot_observed_at":"2026-07-06T17:52:50.835744Z","submitted_at":"2024-03-28T20:35:10Z","title":"Language Models Learn Rare Phenomena from Less Rare Phenomena: The Case of the Missing AANNs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19827","snapshot_observed_at":"2026-08-07T12:13:18.204599Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.204599Z"},"links":{"cited_paper":"/paper/2403.19827","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:1a8fed158874f397c69f61cf9262b5c863f1dafba71edda8326e1770c268bb2e","observation_id":"aebf94c6-0dcc-4975-9a8d-b3ee07eb6fc7","resolution":{"observed_at":"2026-08-07T12:13:18.204599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05217","last_updated":"2023-10-19T21:25:32Z","snapshot_observed_at":"2026-08-02T10:20:00.635719Z","submitted_at":"2023-01-12T18:56:49Z","title":"Progress measures for grokking via mechanistic interpretability","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.05217","snapshot_observed_at":"2026-08-07T12:13:18.242414Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.242414Z"},"links":{"cited_paper":"/paper/2301.05217","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:18a06874867b9c81b491dbc7f481400b92da3fa2cdd53d9213f323847213e016","observation_id":"cc38fca4-fe45-431c-9c57-0e03e2cae629","resolution":{"observed_at":"2026-08-07T12:13:18.242414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1017/s0266466603004109","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:20.323593Z","title":null,"venue":null,"work_id":"42c37689-518d-44ba-9de4-b97dad8d7f96","year":2003},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.308267Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:c44cd30c4cbc75c237418314ce306628e466bdf86ac45d7db9f2fc54e1f647a2","observation_id":"c2dfeb36-b961-4fc3-8601-ecc849ada23a","resolution":{"observed_at":"2026-08-07T12:13:20.396510Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"gov/1717642","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:22.120360Z","title":"Norton, Samuel R","venue":null,"work_id":"cc91e6d1-8c1c-476d-be53-bf8e844b8d13","year":2006},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.353714Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:a2e479b833fc976e85d0385b9b17837778a03fcd2b9702782a8128a1aae1df8f","observation_id":"a4e02824-91e2-44eb-8315-2d05e6bbe815","resolution":{"observed_at":"2026-08-07T12:13:22.193037Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:23.553645Z","title":"Nosek, Anthony G","venue":null,"work_id":"93256a1e-92b0-49c4-b8b7-f3b71695b749","year":2007},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.428035Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:925bca7ba47327f10ceff59069f25ec4e0b1c75b508d539929847a2d6b35575b","observation_id":"d5d56511-f8a6-4701-b478-93e5dfc9d302","resolution":{"observed_at":"2026-08-07T12:13:23.606008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:23.408907Z","title":null,"venue":null,"work_id":"7b51ab76-0ba0-4540-8ed8-a1432d857510","year":2022},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.453442Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:c7243e143bfa67a50eae692c3f29d301911b991343e14ebc01ebb58c043fc449","observation_id":"663161dd-2dd9-4ce3-b2c0-a9d32f946e9e","resolution":{"observed_at":"2026-08-07T12:13:23.461680Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:23.288482Z","title":null,"venue":null,"work_id":"13bb408e-5843-4e72-997f-687b101920e3","year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.494148Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:d0a84e1adbe23a11102bac8ee5715bbe420a8994d1508985ca3af6dbb1c51716","observation_id":"d7e20d09-c0fc-438d-8b05-7fd6ebaa2492","resolution":{"observed_at":"2026-08-07T12:13:23.346962Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-07T14:28:06.805424Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-07T12:13:18.522808Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.522808Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:1532da3dcf4e3e20f20b730e4e07d61db467da96d3b2e9bc58a555bf0f3803be","observation_id":"f53dca34-7fcd-425f-add1-d764bb3a832f","resolution":{"observed_at":"2026-08-07T12:13:18.522808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08193","last_updated":"2022-03-16T01:35:45Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T16:43:46Z","title":"BBQ: A Hand-Built Bias Benchmark for Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08193","snapshot_observed_at":"2026-08-07T12:13:18.554467Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.554467Z"},"links":{"cited_paper":"/paper/2110.08193","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:7de15fbdde27b476c4b9c077f3e61915f90c2d7e201c4a0fe526a9f068809b36","observation_id":"fa03f3aa-6535-4e1f-814a-d6d57c3fa12a","resolution":{"observed_at":"2026-08-07T12:13:18.554467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1086/424719","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:20.208392Z","title":null,"venue":null,"work_id":"a5131eb6-1664-4f26-a619-08887e156ab0","year":2004},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.586340Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:56b05ae56c303887a4708363c7fbb14aa537566626355e2a891510af61d59952","observation_id":"7f9206dc-82bb-4d97-bbb5-fddde5ac9efc","resolution":{"observed_at":"2026-08-07T12:13:20.248908Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12347","last_updated":"2024-06-18T07:28:15Z","snapshot_observed_at":"2026-08-06T09:37:46.017454Z","submitted_at":"2024-06-18T07:28:15Z","title":"Interpreting Bias in Large Language Models: A Feature-Based Approach","version":1},"cited_work":{"arxiv_id":"2406.12347","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.12347","snapshot_observed_at":"2026-08-07T12:13:21.871403Z","title":"Interpreting Bias in Large Language Models: A Feature-Based Approach","venue":"cs.CL","work_id":"27f777c8-4887-4336-a904-382aaf97e051","year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.626848Z"},"links":{"cited_paper":"/paper/2406.12347","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:e1f7ed5f78d45ba31e1963ef86b1b7d5d0e14c1ee087775e97432d491fe6da76","observation_id":"d18a9a1e-ae54-49ad-95ad-42e3b8f0955e","resolution":{"observed_at":"2026-08-07T12:13:21.933327Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:23.148947Z","title":null,"venue":null,"work_id":"dce740b3-6392-4805-b82d-cdfc7722bf39","year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.673799Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:a3c0d561f6b5af3e1b657d8b6b4bfae728a79b61f597410f69023c092e0b5ee6","observation_id":"bd3f5835-517f-4287-8a21-971b9f3e7c35","resolution":{"observed_at":"2026-08-07T12:13:23.195270Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08395","last_updated":"2025-09-10T10:08:08Z","snapshot_observed_at":"2026-07-06T20:35:21.913286Z","submitted_at":"2025-02-12T13:37:03Z","title":"IssueBench: Millions of Realistic Prompts for Measuring Issue Bias in LLM Writing Assistance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08395","snapshot_observed_at":"2026-08-07T12:13:18.714338Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.714338Z"},"links":{"cited_paper":"/paper/2502.08395","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:bf0b2d427d68a08e060536c504b1ed5e9b9d25946a25b0a4f5ab9189b758f594","observation_id":"2d48be1c-cd16-4ea7-a872-ed5fd0e79589","resolution":{"observed_at":"2026-08-07T12:13:18.714338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00754","last_updated":"2023-09-01T22:57:20Z","snapshot_observed_at":"2026-08-04T18:17:27.335093Z","submitted_at":"2023-09-01T22:57:20Z","title":"Efficient RLHF: Reducing the Memory Usage of PPO","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00754","snapshot_observed_at":"2026-08-07T12:13:18.743392Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.743392Z"},"links":{"cited_paper":"/paper/2309.00754","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:a1096b3433cbb50577cb2526d9c9de05c599ca6354907828d35d40812d492bb9","observation_id":"9d141c4d-440b-4d20-8b30-a8982e54cb9d","resolution":{"observed_at":"2026-08-07T12:13:18.743392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10704","last_updated":"2024-09-12T18:25:16Z","snapshot_observed_at":"2026-08-04T05:04:56.942998Z","submitted_at":"2024-03-15T21:43:46Z","title":"Parameter Efficient Reinforcement Learning from Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10704","snapshot_observed_at":"2026-08-07T12:13:18.772325Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.772325Z"},"links":{"cited_paper":"/paper/2403.10704","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:567accfb3cf35c2416a8a5cad4cf1469e76fa6c00fa23fe2c2bfca3653245c2d","observation_id":"a58d3885-7902-467a-b295-3112b6003fad","resolution":{"observed_at":"2026-08-07T12:13:18.772325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/0021886308314460","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:20.116989Z","title":"Stevens, Victoria C","venue":null,"work_id":"e3933ad6-5fb2-409a-8e7b-d3c4304b7e24","year":2008},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.804298Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:d26908649b9687acfeabf06a1166f9579ce50733861ee6652ef9d7a7007ad62e","observation_id":"e5212170-b945-4119-b102-0a9a94a2f5bc","resolution":{"observed_at":"2026-08-07T12:13:20.147034Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12877","last_updated":"2025-04-14T09:04:45Z","snapshot_observed_at":"2026-07-06T19:34:51.296918Z","submitted_at":"2024-10-15T08:38:20Z","title":"Improving Instruction-Following in Language Models through Activation Steering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12877","snapshot_observed_at":"2026-08-07T12:13:18.854878Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.854878Z"},"links":{"cited_paper":"/paper/2410.12877","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:c6c854bce1903f8877cbb16f24e8c0b098e914d33aa8f41a1ef2b8a216fbc243","observation_id":"9657af22-7b98-451f-a8a8-63c6060afb66","resolution":{"observed_at":"2026-08-07T12:13:18.854878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09055","last_updated":"2023-09-16T17:31:36Z","snapshot_observed_at":"2026-08-08T02:15:54.318430Z","submitted_at":"2023-09-16T17:31:36Z","title":"Exploring the impact of low-rank adaptation on the performance, efficiency, and regularization of RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09055","snapshot_observed_at":"2026-08-07T12:13:18.882947Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.882947Z"},"links":{"cited_paper":"/paper/2309.09055","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:26d7314a92fe0aed68d80a2e757045de39ddeeaf54a454141ada1c53e2fb64c6","observation_id":"d67a5ee7-ab89-4cbd-8a08-ebfbdb2eecfb","resolution":{"observed_at":"2026-08-07T12:13:18.882947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05162","last_updated":"2023-07-11T10:38:58Z","snapshot_observed_at":"2026-07-06T15:52:32.458556Z","submitted_at":"2023-07-11T10:38:58Z","title":"SuryaKiran at MEDIQA-Sum 2023: Leveraging LoRA for Clinical Dialogue Summarization","version":1},"cited_work":{"arxiv_id":"2307.05162","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.05162","snapshot_observed_at":"2026-08-07T12:13:21.554494Z","title":"SuryaKiran at MEDIQA-Sum 2023: Leveraging LoRA for Clinical Dialogue Summarization","venue":"cs.CL","work_id":"a1ae1530-ca5e-45a7-9284-d5714300e526","year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.924741Z"},"links":{"cited_paper":"/paper/2307.05162","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:15cef761da05f6acc495b4e15c4696cfa24bebf14d80f261b04b9cd21e3d4f47","observation_id":"38452e32-1802-4a5e-b743-99108b95aee0","resolution":{"observed_at":"2026-08-07T12:13:21.647590Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03689","last_updated":"2023-12-06T18:53:01Z","snapshot_observed_at":"2026-07-06T16:57:51.263433Z","submitted_at":"2023-12-06T18:53:01Z","title":"Evaluating and Mitigating Discrimination in Language Model Decisions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03689","snapshot_observed_at":"2026-08-07T12:13:18.979922Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:18.979922Z"},"links":{"cited_paper":"/paper/2312.03689","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:97fd1e3f06931c238b0a37d1e2e942448a54da094b29e49ce7f2e1107857d753","observation_id":"68ee41b9-5b47-418d-b855-3d6afbe5dc61","resolution":{"observed_at":"2026-08-07T12:13:18.979922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12031","last_updated":"2023-08-17T17:19:02Z","snapshot_observed_at":"2026-08-06T16:28:29.854930Z","submitted_at":"2023-05-19T23:07:09Z","title":"Clinical Camel: An Open Expert-Level Medical Language Model with Dialogue-Based Knowledge Encoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12031","snapshot_observed_at":"2026-08-07T12:13:19.036340Z","title":"Lawler, Jimmy Ba, Rahul G","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:19.036340Z"},"links":{"cited_paper":"/paper/2305.12031","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:2b66ffecd254dcde9c05793787f8019f0de26a7d7eb24ad31547bfddfe55c33d","observation_id":"2e7df569-9d9b-41c6-9fa8-1a2fe05f9e2e","resolution":{"observed_at":"2026-08-07T12:13:19.036340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-07T12:13:19.106538Z","title":"Vazquez, Ulisse Mini, and Monte MacDiarmid","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:19.106538Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:8b7d35f43b9df7b6ddb71cb5bfb976036a8c15d4433a2213ae2c2e81b5291b81","observation_id":"33d965b8-0bd6-42eb-8d4c-014e25b9a186","resolution":{"observed_at":"2026-08-07T12:13:19.106538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:23.025483Z","title":null,"venue":null,"work_id":"3b758c86-79ba-4790-bf8d-3ca3d03a44f5","year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:19.178953Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:16278d07b7ffe4b58aa2b4b53347931616a1deada1d86b80e2862bd771665eb3","observation_id":"2274232a-1bde-4b51-a43f-f0d4ec7d6e0f","resolution":{"observed_at":"2026-08-07T12:13:23.082467Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11698","last_updated":"2024-02-26T20:41:01Z","snapshot_observed_at":"2026-08-07T02:34:39.980213Z","submitted_at":"2023-06-20T17:24:23Z","title":"DecodingTrust: A Comprehensive Assessment of Trustworthiness in GPT Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11698","snapshot_observed_at":"2026-08-07T12:13:19.236371Z","title":"Truong, Simran Arora, Mantas Mazeika, Dan Hendrycks, Zinan Lin, Yu Cheng, Sanmi Koyejo, Dawn Song, and Bo Li","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:19.236371Z"},"links":{"cited_paper":"/paper/2306.11698","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:3b7871b34b7fe79883742ad40eea6545f9bbc23a6037682fb0c57143eeb8d2f4","observation_id":"5724ed5a-dc59-49c0-9876-5279146e77aa","resolution":{"observed_at":"2026-08-07T12:13:19.236371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-07T12:13:19.352932Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:19.352932Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:4a5782ececfd2ae0344df5e1471abdc51543282e516bbf15ee1e6eabc62b2188","observation_id":"25085deb-1076-4066-a0b5-1f3681d0afe1","resolution":{"observed_at":"2026-08-07T12:13:19.352932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02483","last_updated":"2023-07-05T17:58:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-05T17:58:10Z","title":"Jailbroken: How Does LLM Safety Training Fail?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02483","snapshot_observed_at":"2026-08-07T12:13:19.432193Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:19.432193Z"},"links":{"cited_paper":"/paper/2307.02483","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:1ed7baeda234353a53bab828a8edf2ea3d6b15a23486b54a65ed3363c1ada990","observation_id":"a9b299b5-3400-43f7-846d-22f590859600","resolution":{"observed_at":"2026-08-07T12:13:19.432193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11082","last_updated":"2024-06-03T12:19:16Z","snapshot_observed_at":"2026-07-06T15:18:26.300068Z","submitted_at":"2023-04-19T17:50:09Z","title":"Fundamental Limitations of Alignment in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11082","snapshot_observed_at":"2026-08-07T12:13:19.496083Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:19.496083Z"},"links":{"cited_paper":"/paper/2304.11082","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:9a57b39e1d5d2f6d8a667f86bcde274048793aeb1eacef4d8dac00ec13024f54","observation_id":"5e43b040-e749-4864-b1e7-84ea0d259d51","resolution":{"observed_at":"2026-08-07T12:13:19.496083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17148","last_updated":"2025-03-03T21:15:30Z","snapshot_observed_at":"2026-08-07T21:53:39.823463Z","submitted_at":"2025-01-28T18:51:24Z","title":"AxBench: Steering LLMs? Even Simple Baselines Outperform Sparse Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17148","snapshot_observed_at":"2026-08-07T12:13:19.564287Z","title":"Manning, and Christopher Potts","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:19.564287Z"},"links":{"cited_paper":"/paper/2501.17148","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:7ef65c9f3dd3b255f8f41998d7a138224472239938c4d020880fd5cd927e765b","observation_id":"23e4f887-4e7a-45ad-ad63-9c1688b592c9","resolution":{"observed_at":"2026-08-07T12:13:19.564287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12038","last_updated":"2024-11-30T08:52:29Z","snapshot_observed_at":"2026-07-06T18:02:06.709537Z","submitted_at":"2024-04-18T09:46:25Z","title":"Uncovering Safety Risks of Large Language Models through Concept Activation Vector","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12038","snapshot_observed_at":"2026-08-07T12:13:19.638500Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:19.638500Z"},"links":{"cited_paper":"/paper/2404.12038","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:03a10c5799fd4552594cf27715110e04e8b251106860a37c7166fd38969ec31c","observation_id":"5864e4db-8df3-4dce-830e-4957a71edba1","resolution":{"observed_at":"2026-08-07T12:13:19.638500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14888","last_updated":"2024-07-26T04:12:16Z","snapshot_observed_at":"2026-08-06T16:39:32.265073Z","submitted_at":"2024-03-21T23:48:21Z","title":"AutoRE: Document-Level Relation Extraction with Large Language Models","version":3},"cited_work":{"arxiv_id":"2403.14888","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.14888","snapshot_observed_at":"2026-08-07T12:13:21.330926Z","title":"AutoRE: Document-Level Relation Extraction with Large Language Models","venue":"cs.CL","work_id":"0dd0f5b1-153d-4841-b809-b83a3c0a3091","year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:19.714890Z"},"links":{"cited_paper":"/paper/2403.14888","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:fbdb127d3e052c219ee669312f784714b4aa096562d3a7f96a076166f1b1ac36","observation_id":"2a13aa06-7e8b-4911-9eec-797247b2bfa4","resolution":{"observed_at":"2026-08-07T12:13:21.360912Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14457","last_updated":"2025-01-24T12:41:30Z","snapshot_observed_at":"2026-07-06T20:25:31.304367Z","submitted_at":"2025-01-24T12:41:30Z","title":"Understanding and Mitigating Gender Bias in LLMs via Interpretable Neuron Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14457","snapshot_observed_at":"2026-08-07T12:13:19.780988Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:19.780988Z"},"links":{"cited_paper":"/paper/2501.14457","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:1f5709fb0418ce99bd1604c90f042ef54d0225346bf8d422bd603f7d55a28ac1","observation_id":"94cf689b-5052-4457-8597-023c50383804","resolution":{"observed_at":"2026-08-07T12:13:19.780988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16042","last_updated":"2024-01-17T04:07:06Z","snapshot_observed_at":"2026-07-06T16:24:38.375055Z","submitted_at":"2023-09-27T21:53:56Z","title":"Towards Best Practices of Activation Patching in Language Models: Metrics and Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16042","snapshot_observed_at":"2026-08-07T12:13:19.843762Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:19.843762Z"},"links":{"cited_paper":"/paper/2309.16042","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:47c1dc2a42b4a7c6a42a6e281eba45ec8b929eed3dabdabfb81a00eb32be9925","observation_id":"60034b32-2269-4448-a321-ae31c92f7089","resolution":{"observed_at":"2026-08-07T12:13:19.843762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11374","last_updated":"2024-01-17T02:44:56Z","snapshot_observed_at":"2026-08-06T22:00:54.649916Z","submitted_at":"2023-10-17T16:15:34Z","title":"DialogueLLM: Context and Emotion Knowledge-Tuned Large Language Models for Emotion Recognition in Conversations","version":4},"cited_work":{"arxiv_id":"2310.11374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.11374","snapshot_observed_at":"2026-08-07T12:13:21.114171Z","title":"DialogueLLM: Context and Emotion Knowledge-Tuned Large Language Models for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"9a46f539-04d8-47f0-8bfb-18bce8abd774","year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:19.901587Z"},"links":{"cited_paper":"/paper/2310.11374","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:77f78bea9884f13dd471b07e96f0ac6dd9a7a895bc263fd77ee23d4bf5ecc0b1","observation_id":"6a303adf-c8b0-47a8-90e1-7d81d48f201d","resolution":{"observed_at":"2026-08-07T12:13:21.217774Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17844","last_updated":"2023-11-21T17:08:34Z","snapshot_observed_at":"2026-07-06T15:48:55.605324Z","submitted_at":"2023-06-30T17:59:13Z","title":"The Clock and the Pizza: Two Stories in Mechanistic Explanation of Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17844","snapshot_observed_at":"2026-08-07T12:13:19.962960Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:19.962960Z"},"links":{"cited_paper":"/paper/2306.17844","citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:86312ac285f999adf5762a7d4779890962a3a7efd45bf9a8b4e931e8fe1eafe7","observation_id":"24a1d6c1-3256-4b83-bf4b-bf345a072fad","resolution":{"observed_at":"2026-08-07T12:13:19.962960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:20.045313Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:20.045313Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:8fce3a85c5728868ecbc2d3c4799309fd93fb13d43ca9227e21c647fa1d2351a","observation_id":"c4d24a5c-c423-4b35-bcbe-afa331c8565e","resolution":{"observed_at":"2026-08-07T12:13:20.045313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:20.054591Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race","version":3},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T12:13:20.054591Z"},"links":{"citing_paper":"/paper/2506.00253"},"observation_digest":"sha256:0f7b44033be9a3930ce6953953c4e97cb699291abb065cb4e680c447f35096c3","observation_id":"76c487d5-46d7-409a-9876-765a1bab2955","resolution":{"observed_at":"2026-08-07T12:13:20.054591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00253","last_updated":"2025-06-08T23:37:10Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T21:55:20.181434Z","submitted_at":"2025-05-30T21:41:44Z","title":"Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":61,"verified_exact":14,"verified_fuzzy":2},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 0 inbound Pith citation observations for arXiv:2506.00253."}