{"as_of":"2026-08-11T08:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1009ce2f0eb69fe4d80450f65d9a0607fa9430c820246d12a3c3cd83c48b40ec","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":33,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:38:37.043217Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":7,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-11T04:38:37.043217Z","title":"Rainbow teaming: Open-ended generation of diverse adversarial prompts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18693","last_updated":"2024-12-24T22:38:46Z","snapshot_observed_at":"2026-08-11T04:31:44.481545Z","submitted_at":"2024-12-24T22:38:46Z","title":"Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T04:38:37.043217Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2412.18693"},"observation_digest":"sha256:5c5dab24207cca4dcddeff8995f1d4ab0d8bb0557a4dc043dcd90ad4cf08c931","observation_id":"75bd1147-8474-4be8-a15a-a528a8d57538","resolution":{"observed_at":"2026-08-11T04:38:37.043217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-10T22:25:54.672598Z","title":"C., Lupu, A., Hambro, E., Markosyan, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01830","last_updated":"2025-01-03T14:30:14Z","snapshot_observed_at":"2026-08-11T03:10:45.471743Z","submitted_at":"2025-01-03T14:30:14Z","title":"Auto-RT: Automatic Jailbreak Strategy Exploration for Red-Teaming Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T22:25:54.672598Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2501.01830"},"observation_digest":"sha256:039357e5dff10a8543d2a86dca38a870157744f8e33d7764de32c97356524775","observation_id":"dd77d7f6-02ec-4205-8652-27790d29f87f","resolution":{"observed_at":"2026-08-10T22:25:54.672598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-10T16:30:10.095362Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13075","last_updated":"2025-01-22T18:38:41Z","snapshot_observed_at":"2026-08-10T16:46:30.505830Z","submitted_at":"2025-01-22T18:38:41Z","title":"Evolution and The Knightian Blindspot of Machine Learning","version":1},"reference_index":170,"source":"pdf_text","source_observed_at":"2026-08-10T16:30:10.095362Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2501.13075"},"observation_digest":"sha256:e8d42728c87b3351634386c54204355333be018db8344fdf46ec63db062b74b3","observation_id":"3a6aea85-023d-47f7-98f7-81359c39ed58","resolution":{"observed_at":"2026-08-10T16:30:10.095362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-09T22:47:04.444256Z","title":"Markosyan, Manish Bhatt, Yuning Mao, Minqi Jiang, Jack Parker-Holder, Jakob Foerster, Tim Rocktäschel, and Roberta Raileanu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18723","last_updated":"2025-01-30T19:56:04Z","snapshot_observed_at":"2026-08-11T07:53:56.172880Z","submitted_at":"2025-01-30T19:56:04Z","title":"Scaling Policy Gradient Quality-Diversity with Massive Parallelization via Behavioral Variations","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T22:47:04.444256Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2501.18723"},"observation_digest":"sha256:fe656bf7c12d4f70817c15cad6fad85849409d8afb7ddf700103ccedbcc01e06","observation_id":"19724a5d-3f5b-483a-9256-2516f451495b","resolution":{"observed_at":"2026-08-09T22:47:04.444256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":"2402.16822","doi":"10.48550/arxiv.2402.16822","metadata_source":"pith","pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Raparthy, Andrei Lupu, Eric Hambro, Aram H","venue":"cs.CL","work_id":"d6939128-25f0-4e03-8c04-3dd198db6a8e","year":2024},"citing_paper":{"arxiv_id":"2501.18837","last_updated":"2025-01-31T01:09:32Z","snapshot_observed_at":"2026-08-08T23:58:18.293467Z","submitted_at":"2025-01-31T01:09:32Z","title":"Constitutional Classifiers: Defending against Universal Jailbreaks across Thousands of Hours of Red Teaming","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-17T22:20:42.722655Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2501.18837"},"observation_digest":"sha256:4134ca255bb57e08f2cfcafbac3557d6bd60455eee4fd9f1df903efbea3f2d89","observation_id":"f15d3a20-9433-4811-8118-db662e810c47","resolution":{"observed_at":"2026-05-17T22:20:42.806533Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-09T14:49:08.815088Z","title":"1, 4, 14 Shao, Z., Wang, P., Zhu, Q., Xu, R., Song, J., Bi, X., Zhang, H., Zhang, M., Li, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01633","last_updated":"2025-06-25T15:31:17Z","snapshot_observed_at":"2026-08-10T10:28:44.531999Z","submitted_at":"2025-02-03T18:59:01Z","title":"Adversarial Reasoning at Jailbreaking Time","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T14:49:08.815088Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2502.01633"},"observation_digest":"sha256:93e9e8ec7703dd2b727317c0e9bc39312292f125d396a7949f74c5ff6ddbd475","observation_id":"56cb1e1e-e204-4796-b455-02acb15c60e8","resolution":{"observed_at":"2026-08-09T14:49:08.815088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-09T17:09:15.388084Z","title":"Markosyan, Manish Bhatt, Yuning Mao, Minqi Jiang, Jack Parker-Holder, Jakob Foerster, Tim Rocktäschel, and Roberta Raileanu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01697","last_updated":"2025-05-21T17:50:43Z","snapshot_observed_at":"2026-08-10T10:07:25.758530Z","submitted_at":"2025-02-03T00:12:40Z","title":"BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T17:09:15.388084Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2502.01697"},"observation_digest":"sha256:0327b62a3401c88327e4f6b15bddd9cf3a597dbc90d8edfe3644ee88c516fd95","observation_id":"6ffe84fd-eaf0-4e13-921e-e69b834f062a","resolution":{"observed_at":"2026-08-09T17:09:15.388084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-09T04:22:00.561961Z","title":"C., Lupu, A., Hambro, E., Markosyan, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05223","last_updated":"2025-02-05T21:50:34Z","snapshot_observed_at":"2026-08-09T05:14:54.791831Z","submitted_at":"2025-02-05T21:50:34Z","title":"KDA: A Knowledge-Distilled Attacker for Generating Diverse Prompts to Jailbreak LLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:00.561961Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2502.05223"},"observation_digest":"sha256:0c287bbf91800798835fbe2c526911d66657e97b45601a48b312b417c272a7c9","observation_id":"8b8c48c7-1360-46d9-8230-a3935d895ddc","resolution":{"observed_at":"2026-08-09T04:22:00.561961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-08T15:02:49.134884Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06585","last_updated":"2025-02-10T15:52:58Z","snapshot_observed_at":"2026-08-08T15:50:29.543903Z","submitted_at":"2025-02-10T15:52:58Z","title":"Extract-QD Framework: A Generic Approach for Quality-Diversity in Noisy, Stochastic or Uncertain Domains","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T15:02:49.134884Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2502.06585"},"observation_digest":"sha256:65d75439eef1d79d204cecae776c81345995db8cbcaf01864156127826985a2c","observation_id":"f1af57d7-b3d5-4e91-8e9b-bee4467e6772","resolution":{"observed_at":"2026-08-08T15:02:49.134884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-08T04:58:33.981545Z","title":"Rainbow teaming: Open-ended generation of diverse adversarial prompts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08489","last_updated":"2025-02-13T17:33:24Z","snapshot_observed_at":"2026-08-10T11:23:02.731143Z","submitted_at":"2025-02-12T15:26:08Z","title":"Salamandra Technical Report","version":2},"reference_index":168,"source":"pdf_text","source_observed_at":"2026-08-08T04:58:33.981545Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2502.08489"},"observation_digest":"sha256:6d0b323080c0d369117e226b929f2ebc29ce1f17a3efd81a1b425d78b9475b9c","observation_id":"f30bdc16-e10a-4d89-b134-e5bbd1b09077","resolution":{"observed_at":"2026-08-08T04:58:33.981545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-07T19:32:24.103244Z","title":"Rain- bow teaming: Open-ended generation of diverse adversarial prompts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.10487","last_updated":"2025-02-14T11:15:27Z","snapshot_observed_at":"2026-08-10T04:59:46.410720Z","submitted_at":"2025-02-14T11:15:27Z","title":"Fast Proxies for LLM Robustness Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T19:32:24.103244Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2502.10487"},"observation_digest":"sha256:91041033b0515d76cfbad1efcda56d3acedeea3a6312f13e2090eb814af5dbd6","observation_id":"598f292b-bfcb-41c2-b320-390c0e68616d","resolution":{"observed_at":"2026-08-07T19:32:24.103244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-07T14:26:35.108420Z","title":"Markosyan, Manish Bhatt, Yuning Mao, Minqi Jiang, Jack Parker-Holder, Jakob Foerster, Tim Rocktäschel, and Roberta Raileanu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18893","last_updated":"2025-05-30T14:09:51Z","snapshot_observed_at":"2026-08-09T08:24:03.844078Z","submitted_at":"2025-05-24T22:35:32Z","title":"Reality Check: A New Evaluation Ecosystem Is Necessary to Understand AI's Real World Effects","version":4},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T14:26:35.108420Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2505.18893"},"observation_digest":"sha256:0fbde645a4680efbaf3d074a6cf5f500a764550fd55bdc499010c29e57d484d6","observation_id":"c98d380a-778d-4c31-a646-cc36ab0d7ed6","resolution":{"observed_at":"2026-08-07T14:26:35.108420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-07T12:35:22.717519Z","title":"Markosyan, Manish Bhatt, Yuning Mao, Minqi Jiang, Jack Parker-Holder, Jakob Foerster, Tim Rocktäschel, and Roberta Raileanu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24369","last_updated":"2025-05-30T09:02:07Z","snapshot_observed_at":"2026-08-09T16:12:29.442194Z","submitted_at":"2025-05-30T09:02:07Z","title":"Adversarial Preference Learning for Robust LLM Alignment","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:22.717519Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2505.24369"},"observation_digest":"sha256:197c106833c4334a835f4e1ac69223a179b71d57d174c6fdf703e854459fd0a7","observation_id":"83f0cf37-bc8d-4ff8-9581-8ce543e484f8","resolution":{"observed_at":"2026-08-07T12:35:22.717519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-07T05:47:06.411541Z","title":"Samvelyan, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.411541Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:2d61cd187f17d82c550e7fc0ba558ab37e846d0befad756dd14d015dd785aaf4","observation_id":"218d1088-3bf5-40a8-8729-f2bc379ba839","resolution":{"observed_at":"2026-08-07T05:47:06.411541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-07T05:41:25.478376Z","title":"Markosyan, Manish Bhatt, Yuning Mao, Minqi Jiang, Jack Parker-Holder, Jakob Foerster, Tim Rocktäschel, and Roberta Raileanu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-08T01:51:03.511040Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.478376Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:6029539dd6232b21fbd3233569f367f41d4e920e5740ef6410341a4a112aa180","observation_id":"35009d95-66aa-4b6f-83aa-3f26744e32df","resolution":{"observed_at":"2026-08-07T05:41:25.478376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-07T05:41:58.117338Z","title":"Markosyan, Manish Bhatt, Yuning Mao, Minqi Jiang, Jack Parker-Holder, Jakob Foerster, Tim Rocktäschel, and Roberta Raileanu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07468","last_updated":"2026-07-06T07:31:35Z","snapshot_observed_at":"2026-08-07T05:30:38.669027Z","submitted_at":"2025-06-09T06:35:12Z","title":"Chasing Moving Targets with Online Self-Play Reinforcement Learning for Safer Language Models","version":4},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:58.117338Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2506.07468"},"observation_digest":"sha256:7b7c4aaa93fed1d608a6a1ea268a25b7f9dd9399e19f875b0ea7341d239d863a","observation_id":"195be6b8-681c-42b3-8ed0-dd4c458f7a3a","resolution":{"observed_at":"2026-08-07T05:41:58.117338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-07T04:47:42.443980Z","title":"Rainbow teaming: Open-ended generation of diverse adversarial prompts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09659","last_updated":"2025-06-11T12:26:45Z","snapshot_observed_at":"2026-08-11T00:50:34.571807Z","submitted_at":"2025-06-11T12:26:45Z","title":"Intent Factored Generation: Unleashing the Diversity in Your Language Model","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:47:42.443980Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2506.09659"},"observation_digest":"sha256:e7fe73e6ffd545ed8a5342559005c494b39132b586ac340f863130889ec310b8","observation_id":"a1f24584-a178-4256-8d95-67fa1e2fe531","resolution":{"observed_at":"2026-08-07T04:47:42.443980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-06T23:49:54.533216Z","title":"Preprint, arXiv:2402.16822","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16322","last_updated":"2025-06-19T13:56:41Z","snapshot_observed_at":"2026-08-07T20:46:18.050527Z","submitted_at":"2025-06-19T13:56:41Z","title":"PL-Guard: Benchmarking Language Model Safety for Polish","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:54.533216Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2506.16322"},"observation_digest":"sha256:83c7b7eb1f7ef4289802f62431150a4b2f4b0cefd2ca4799151fc14ecc8246a8","observation_id":"1cb4159f-6176-4025-95d0-185f464b418e","resolution":{"observed_at":"2026-08-06T23:49:54.533216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":"2402.16822","doi":"10.48550/arxiv.2402.16822","metadata_source":"pith","pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Raparthy, Andrei Lupu, Eric Hambro, Aram H","venue":"cs.CL","work_id":"d6939128-25f0-4e03-8c04-3dd198db6a8e","year":2024},"citing_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-19T05:48:02.828938Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2507.06261"},"observation_digest":"sha256:99d426780fbb2a8222cee4bff098b31dbd407f5033da5d3192b21b0bbe6d2f11","observation_id":"faa06f18-e6ec-47ba-8560-a1751097701b","resolution":{"observed_at":"2026-05-19T05:52:07.717107Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-06T14:13:06.225634Z","title":"Raparthy, Andre Lupu, Emily Hambro, and Jakob Foerster","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19672","last_updated":"2025-07-25T20:52:58Z","snapshot_observed_at":"2026-08-07T12:02:14.124506Z","submitted_at":"2025-07-25T20:52:58Z","title":"Alignment and Safety in Large Language Models: Safety Mechanisms, Training Paradigms, and Emerging Challenges","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-06T14:13:06.225634Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2507.19672"},"observation_digest":"sha256:01997a4b8a249248716994d1112b01ef3656050fa3086c8436e46d498a4befcc","observation_id":"ef009d23-5b22-45d3-b7d2-722cd1089486","resolution":{"observed_at":"2026-08-06T14:13:06.225634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-04T20:24:40.737305Z","title":"Samvelyan, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08653","last_updated":"2025-09-11T11:18:17Z","snapshot_observed_at":"2026-08-07T20:32:11.024796Z","submitted_at":"2025-09-10T14:49:12Z","title":"Generative Data Refinement: Just Ask for Better Data","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T20:24:40.737305Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2509.08653"},"observation_digest":"sha256:97e456f74e650e1b7e68394ad880cd67f661e35854f9ff36bd460fd2ef45e0ba","observation_id":"c66b72ee-4876-4867-803b-832d3130badf","resolution":{"observed_at":"2026-08-04T20:24:40.737305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-03T22:03:19.769157Z","title":"ArXivabs/2402.16822(2024),https://api.semanticscholar.org/CorpusID: 268031888","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.12487","last_updated":"2026-01-24T06:07:58Z","snapshot_observed_at":"2026-08-10T20:30:25.913026Z","submitted_at":"2025-11-16T07:47:31Z","title":"ToxSearch: Evolving Prompts for Toxicity Search in Large Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T22:03:19.769157Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2511.12487"},"observation_digest":"sha256:3e981cdf592307ceaf84721dc1175922a3c8be76d7b8bcb50cb60314c04426ca","observation_id":"3c3e42de-9389-4c66-b35c-2cc5ea3cff9b","resolution":{"observed_at":"2026-08-03T22:03:19.769157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":"2402.16822","doi":"10.48550/arxiv.2402.16822","metadata_source":"pith","pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Raparthy, Andrei Lupu, Eric Hambro, Aram H","venue":"cs.CL","work_id":"d6939128-25f0-4e03-8c04-3dd198db6a8e","year":2024},"citing_paper":{"arxiv_id":"2601.19562","last_updated":"2026-05-15T09:01:29Z","snapshot_observed_at":"2026-07-06T22:43:12.468415Z","submitted_at":"2026-01-27T12:55:23Z","title":"Tournament Informed Adversarial Quality Diversity","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-21T14:41:43.611099Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2601.19562"},"observation_digest":"sha256:8c148e2c5de61de3409d4c5f3b1dadd476aeba9dfb6b4f0b789f6c9c77150146","observation_id":"39a178c3-7ada-42d9-81f2-e235edb87298","resolution":{"observed_at":"2026-05-21T14:44:12.879981Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-04T06:18:34.918499Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.01347","last_updated":"2026-08-03T13:57:33Z","snapshot_observed_at":"2026-08-10T07:20:41.626503Z","submitted_at":"2026-02-01T17:32:04Z","title":"A clinically validated framework for auditing AI chatbot behavior in mental health interactions","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T06:18:34.918499Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2602.01347"},"observation_digest":"sha256:8ceef01075f481773ab12330e701859f68e182340c315391d8f0cb16b79cf2da","observation_id":"68ee0ac2-877e-4913-913b-d5cacc2c8828","resolution":{"observed_at":"2026-08-04T06:18:34.918499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":"2402.16822","doi":"10.48550/arxiv.2402.16822","metadata_source":"pith","pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Raparthy, Andrei Lupu, Eric Hambro, Aram H","venue":"cs.CL","work_id":"d6939128-25f0-4e03-8c04-3dd198db6a8e","year":2024},"citing_paper":{"arxiv_id":"2604.24983","last_updated":"2026-04-27T20:39:08Z","snapshot_observed_at":"2026-07-06T23:10:57.164248Z","submitted_at":"2026-04-27T20:39:08Z","title":"Adaptive Prompt Embedding Optimization for LLM Jailbreaking","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T03:28:32.989179Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2604.24983"},"observation_digest":"sha256:ae9bbe625b4896821a34d540e1dd0a1dde8074c2dd667d5afd65554e4d62d77e","observation_id":"b3df1c9b-7655-4087-98b2-a5df797a8703","resolution":{"observed_at":"2026-05-11T22:06:14.523858Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":"2402.16822","doi":"10.48550/arxiv.2402.16822","metadata_source":"pith","pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Raparthy, Andrei Lupu, Eric Hambro, Aram H","venue":"cs.CL","work_id":"d6939128-25f0-4e03-8c04-3dd198db6a8e","year":2024},"citing_paper":{"arxiv_id":"2605.02647","last_updated":"2026-05-04T14:32:40Z","snapshot_observed_at":"2026-07-06T23:15:41.793878Z","submitted_at":"2026-05-04T14:32:40Z","title":"ContextualJailbreak: Evolutionary Red-Teaming via Simulated Conversational Priming","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T19:16:21.173184Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2605.02647"},"observation_digest":"sha256:dc73635731f817d444d9502fb8ff96b51a9b66753957e695b990acd218c07d40","observation_id":"64af6f05-e74a-4332-b31c-976feb0e2151","resolution":{"observed_at":"2026-05-09T05:55:32.384542Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":"2402.16822","doi":"10.48550/arxiv.2402.16822","metadata_source":"pith","pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Raparthy, Andrei Lupu, Eric Hambro, Aram H","venue":"cs.CL","work_id":"d6939128-25f0-4e03-8c04-3dd198db6a8e","year":2024},"citing_paper":{"arxiv_id":"2605.04019","last_updated":"2026-05-05T17:43:52Z","snapshot_observed_at":"2026-07-06T23:16:49.553583Z","submitted_at":"2026-05-05T17:43:52Z","title":"Redefining AI Red Teaming in the Agentic Era: From Weeks to Hours","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-07T16:06:18.057868Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2605.04019"},"observation_digest":"sha256:faee3f6e2ae61825071acfe2899828493124c677119a8814ab6f30ab837c6e5f","observation_id":"a5483ee6-d8cc-43d9-8e97-9aefb73693c0","resolution":{"observed_at":"2026-05-11T23:51:44.936396Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":"2402.16822","doi":"10.48550/arxiv.2402.16822","metadata_source":"pith","pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Raparthy, Andrei Lupu, Eric Hambro, Aram H","venue":"cs.CL","work_id":"d6939128-25f0-4e03-8c04-3dd198db6a8e","year":2024},"citing_paper":{"arxiv_id":"2605.06213","last_updated":"2026-05-26T15:14:12Z","snapshot_observed_at":"2026-07-06T23:18:41.400741Z","submitted_at":"2026-05-07T13:15:31Z","title":"Beyond Fixed Benchmarks and Worst-Case Attacks: Dynamic Boundary Evaluation for Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T10:13:35.777910Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2605.06213"},"observation_digest":"sha256:84d331c1b4dc7a2ef62a11eab47b18d9f156937a32a125d3bc48ca58070b9c9c","observation_id":"2b01cfc6-d632-40df-87f4-b91bf1760602","resolution":{"observed_at":"2026-05-08T22:09:18.138783Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":"2402.16822","doi":"10.48550/arxiv.2402.16822","metadata_source":"pith","pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Raparthy, Andrei Lupu, Eric Hambro, Aram H","venue":"cs.CL","work_id":"d6939128-25f0-4e03-8c04-3dd198db6a8e","year":2024},"citing_paper":{"arxiv_id":"2605.15721","last_updated":"2026-05-15T08:17:21Z","snapshot_observed_at":"2026-08-03T02:20:03.310384Z","submitted_at":"2026-05-15T08:17:21Z","title":"Contexting as Recommendation: Evolutionary Collaborative Filtering for Context Engineering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T19:05:58.638818Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2605.15721"},"observation_digest":"sha256:d182815e1fdcfb725c23413bd8c3e87f01fb83692a171d4239993d08349dae46","observation_id":"cb02b00f-60bc-42f5-9194-7e86318bf190","resolution":{"observed_at":"2026-05-20T19:08:54.411605Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":"2402.16822","doi":"10.48550/arxiv.2402.16822","metadata_source":"pith","pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Raparthy, Andrei Lupu, Eric Hambro, Aram H","venue":"cs.CL","work_id":"d6939128-25f0-4e03-8c04-3dd198db6a8e","year":2024},"citing_paper":{"arxiv_id":"2606.00801","last_updated":"2026-05-30T16:40:24Z","snapshot_observed_at":"2026-08-04T17:47:17.706554Z","submitted_at":"2026-05-30T16:40:24Z","title":"Quality-Diversity Evolution for Discovering Diverse Vulnerabilities in LLM Safety","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T18:33:58.265424Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2606.00801"},"observation_digest":"sha256:9cff972bafdab2283d6e78333e53e5b7046b7c781b2f1fcacdec7af4633a8c4b","observation_id":"c1eb8b4c-00d6-4e95-bf3d-17579a1e0391","resolution":{"observed_at":"2026-06-28T20:32:37.956663Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":"2402.16822","doi":"10.48550/arxiv.2402.16822","metadata_source":"pith","pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Raparthy, Andrei Lupu, Eric Hambro, Aram H","venue":"cs.CL","work_id":"d6939128-25f0-4e03-8c04-3dd198db6a8e","year":2024},"citing_paper":{"arxiv_id":"2606.01441","last_updated":"2026-05-31T20:20:53Z","snapshot_observed_at":"2026-08-05T08:36:53.588712Z","submitted_at":"2026-05-31T20:20:53Z","title":"Dive into Ambiguity: A*-Inspired Multi-Agents Commonsense Obfuscation Attack on LLM Prompts","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T16:54:12.354178Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2606.01441"},"observation_digest":"sha256:0fdf038fb5c0e4faf70eb95243fede705f65874a854308f78bf595d62db8b945","observation_id":"9f21f96e-b2a8-4865-b0ab-7f5f3fb0a262","resolution":{"observed_at":"2026-07-01T21:26:16.377808Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":"2402.16822","doi":"10.48550/arxiv.2402.16822","metadata_source":"pith","pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Raparthy, Andrei Lupu, Eric Hambro, Aram H","venue":"cs.CL","work_id":"d6939128-25f0-4e03-8c04-3dd198db6a8e","year":2024},"citing_paper":{"arxiv_id":"2606.07535","last_updated":"2026-04-24T09:29:14Z","snapshot_observed_at":"2026-08-03T04:03:26.597230Z","submitted_at":"2026-04-24T09:29:14Z","title":"Multilingual Refusal Alignment for Safer Large Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-07-04T18:09:17.531727Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2606.07535"},"observation_digest":"sha256:11d87f59511f023e28632250268830f8f3dd16c815bfca585fa808b1d4535b41","observation_id":"772504b9-01de-4a05-8e61-1d28c19db17d","resolution":{"observed_at":"2026-07-04T18:10:00.776045Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":"2402.16822","doi":"10.48550/arxiv.2402.16822","metadata_source":"pith","pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Raparthy, Andrei Lupu, Eric Hambro, Aram H","venue":"cs.CL","work_id":"d6939128-25f0-4e03-8c04-3dd198db6a8e","year":2024},"citing_paper":{"arxiv_id":"2607.07918","last_updated":"2026-07-08T21:03:27Z","snapshot_observed_at":"2026-08-05T10:24:34.449076Z","submitted_at":"2026-07-08T21:03:27Z","title":"Efficient Safety Alignment of Language Models via Latent Personality Traits","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-10T15:26:23.290009Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2607.07918"},"observation_digest":"sha256:d2e6da45078e2ec7e6ccd6467db0f8d1e4e86525841bd7bea63dc39b67e4c992","observation_id":"0a34a515-b193-45e0-8450-b95ee5182d2e","resolution":{"observed_at":"2026-07-10T15:27:20.032546Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2402.16822/citation-record","integrity":"/paper/2402.16822/integrity","json":"/paper/2402.16822/citation-record.json","paper":"/paper/2402.16822"},"outbound":[],"paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 33 inbound Pith citation observations for arXiv:2402.16822."}