{"as_of":"2026-08-08T18:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3b8d9d892c775c5ea63eba77db487d80e22c946d7882d674a28d3405f64d546a","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:47:06.558987Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-25T22:12:27.301100Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:00:04.605664Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"cited_work":{"arxiv_id":"2506.07121","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07121","snapshot_observed_at":"2026-08-04T00:35:57.161442Z","title":"arXiv preprint arXiv:2506.07121 (2025)","venue":null,"work_id":"cd977e73-c80f-4495-a5a1-4ca57eacb431","year":2025},"citing_paper":{"arxiv_id":"2601.19562","last_updated":"2026-05-15T09:01:29Z","snapshot_observed_at":"2026-07-06T22:43:12.468415Z","submitted_at":"2026-01-27T12:55:23Z","title":"Tournament Informed Adversarial Quality Diversity","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-21T14:41:43.611099Z"},"links":{"cited_paper":"/paper/2506.07121","citing_paper":"/paper/2601.19562"},"observation_digest":"sha256:1ee5fc05a0fbc28f4d1ee794f74ba648e79a89f475551057dddcece8460fedb9","observation_id":"f015c13a-2d8d-4790-8628-3127621d592f","resolution":{"observed_at":"2026-08-04T00:35:57.161442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"cited_work":{"arxiv_id":"2506.07121","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07121","snapshot_observed_at":"2026-08-04T00:35:57.161442Z","title":"arXiv preprint arXiv:2506.07121 (2025)","venue":null,"work_id":"cd977e73-c80f-4495-a5a1-4ca57eacb431","year":2025},"citing_paper":{"arxiv_id":"2606.24166","last_updated":"2026-06-23T05:40:05Z","snapshot_observed_at":"2026-07-06T23:58:49.574536Z","submitted_at":"2026-06-23T05:40:05Z","title":"Distributed Quality-Diversity Search for Toxicity in Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-25T22:12:27.301100Z"},"links":{"cited_paper":"/paper/2506.07121","citing_paper":"/paper/2606.24166"},"observation_digest":"sha256:f8b231d8da7c8f04455dd791c3639c2c2406d38ed4659c22a734369e1a1c15b2","observation_id":"9e8e7acf-9393-4c24-af9a-9d35fa36ac03","resolution":{"observed_at":"2026-08-04T00:35:57.161442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07121/citation-record","integrity":"/paper/2506.07121/integrity","json":"/paper/2506.07121/citation-record.json","paper":"/paper/2506.07121"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:11.818233Z","title":"Bäck.Evolutionary Algorithms in Theory and Practice: Evolution Strategies, Evolutionary Programming, Genetic Algorithms","venue":null,"work_id":"71e7bdbe-bf1c-47a4-8064-eea3859d855d","year":1996},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.251667Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:7f68410d8c56d9f918319695f958be0848fae93f17a688b0aa00b16d2504b70e","observation_id":"16b8b83b-c6ef-4787-8c66-4d730b2945c5","resolution":{"observed_at":"2026-08-07T05:47:11.891490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T05:47:06.256235Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.256235Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:0498d9011360e4d3da4481a999a0ec2c179ad6910ca0c5dbf639796beb60aa83","observation_id":"b45a99a4-a292-469a-a569-5218b2495979","resolution":{"observed_at":"2026-08-07T05:47:06.256235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:11.691805Z","title":"Bengio, M","venue":null,"work_id":"9be03cfe-8b98-41b2-b9e6-8cd302a75865","year":2021},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.260556Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:42fef1579c61d8c830471ef296cb386d07da063f3e1d5b239e1aad2ce4c2f11e","observation_id":"e9dcd942-c6fd-41a4-92ee-878613cc5026","resolution":{"observed_at":"2026-08-07T05:47:11.747496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18693","last_updated":"2024-12-24T22:38:46Z","snapshot_observed_at":"2026-07-06T20:12:59.152345Z","submitted_at":"2024-12-24T22:38:46Z","title":"Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18693","snapshot_observed_at":"2026-08-07T05:47:06.264820Z","title":"Beutel, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.264820Z"},"links":{"cited_paper":"/paper/2412.18693","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:d41ab9bd28b0712054118c99b57c1bd9ba3ff1f8dcb7471a7221fc23c344ac4a","observation_id":"ac7ef433-3e74-412b-8fe7-9589df932fb0","resolution":{"observed_at":"2026-08-07T05:47:06.264820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:11.494315Z","title":"Bhatt, B","venue":null,"work_id":"55e94193-2a66-41fd-814e-f3008f1bb665","year":2022},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.269299Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:273da094e9364f6c0e01dea631e810829591b85d8e9cc8815fdfde00a1c4caca","observation_id":"3141330c-abd4-4866-911e-a540ea84100b","resolution":{"observed_at":"2026-08-07T05:47:11.587281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:11.361794Z","title":"Bianchi, M","venue":null,"work_id":"4b133ff0-3149-4091-a465-497e0c794fe6","year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.273051Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:88f7f2a7336da2ee6a4157546593d7cc6c1fe7d0937776df50533966542ab3f5","observation_id":"205fa3cf-e466-49d4-841d-5844d4af3fdf","resolution":{"observed_at":"2026-08-07T05:47:11.447849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T05:47:06.277530Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.277530Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:77432b1aa4f4dbc19f15a84aba585d0e94668cc2b5006a8f73f75fb880c36d19","observation_id":"c0505b0c-494e-4ba0-b255-77ad9efbf934","resolution":{"observed_at":"2026-08-07T05:47:06.277530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:11.230821Z","title":"Chatzilygeroudis, A","venue":null,"work_id":"f582c507-4bec-430b-ba6f-21357be998ab","year":2021},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.281915Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:600b27ae8d95d2daf6725a142ee31847d9a0d1a4a282053ffc0eee2107c8e6cc","observation_id":"0bce8597-c33f-498b-841e-205498b47675","resolution":{"observed_at":"2026-08-07T05:47:11.292316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:11.052839Z","title":"Cully, J","venue":null,"work_id":"f368ad30-eb24-47f0-a6c8-dd8882611463","year":2015},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.285343Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:11d0b7faed3794230a657838c8f0466193dad4b5168cd9989395e4d59b300cd1","observation_id":"2779af8e-5a61-40dc-a169-88a2ce94f46e","resolution":{"observed_at":"2026-08-07T05:47:11.121094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:10.934658Z","title":"Cully and Y","venue":null,"work_id":"df3a3f40-4396-4cb1-8ea8-f47021b3b1cc","year":2018},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.289172Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:a825737b522aeeb9410295581ab55c5956cdc74f101da0175f290209861e0834","observation_id":"6ac7622e-3a96-4669-b718-b99dc3abe6ff","resolution":{"observed_at":"2026-08-07T05:47:10.976374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:10.800135Z","title":"Dathathri, A","venue":null,"work_id":"07afe18b-48fd-4914-bcb6-5cff5be738da","year":2020},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.292756Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:44a64a966c2998a72328fcc622cb2b5a21a073d403d7222698781f9be54f87d1","observation_id":"52b78b70-fde6-4433-bcea-01cbdd5673dd","resolution":{"observed_at":"2026-08-07T05:47:10.844299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06083","last_updated":"2019-08-17T18:34:11Z","snapshot_observed_at":"2026-08-08T03:38:10.333686Z","submitted_at":"2019-08-17T18:34:11Z","title":"Build it Break it Fix it for Dialogue Safety: Robustness from Adversarial Human Attack","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.06083","snapshot_observed_at":"2026-08-07T05:47:06.296744Z","title":"Dinan, S","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.296744Z"},"links":{"cited_paper":"/paper/1908.06083","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:691acfc04802bcf70499ded9ef1eda3c84be7c0eb20566f38099609b3a9d8e19","observation_id":"73945fed-74a1-482b-bf8d-7a752a747947","resolution":{"observed_at":"2026-08-07T05:47:06.296744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T05:47:06.300783Z","title":"Dubey, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.300783Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:157b2a176e8c6a5e31a723f0dddb88fa9b815dae3295fa7238717142eff550b0","observation_id":"375a866a-b92f-4ba6-bbaf-04ca2fac08c4","resolution":{"observed_at":"2026-08-07T05:47:06.300783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:10.615440Z","title":"Ecoffet, J","venue":null,"work_id":"298eb8fe-4953-46b4-a847-ebf7de473969","year":2021},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.304222Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:43a90332a9bcfebe9a464ea2547fc0e7f86c9b3424332522e511ffea170e26bd","observation_id":"9ef6d47e-f5a0-4dd4-8df4-a60d38d7cfec","resolution":{"observed_at":"2026-08-07T05:47:10.667358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.02193","last_updated":"2022-11-04T00:14:42Z","snapshot_observed_at":"2026-07-06T14:14:18.434647Z","submitted_at":"2022-11-04T00:14:42Z","title":"Benchmarking Quality-Diversity Algorithms on Neuroevolution for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.02193","snapshot_observed_at":"2026-08-07T05:47:06.307492Z","title":"Flageat, B","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.307492Z"},"links":{"cited_paper":"/paper/2211.02193","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:c9e711c3ac07e4afd2c140d093493f64d9ddfced4315b68b931efce23126f824","observation_id":"fcddd2d1-5c59-4c25-8599-be5603c40fb7","resolution":{"observed_at":"2026-08-07T05:47:06.307492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:10.425922Z","title":null,"venue":null,"work_id":"569c32a2-e522-4d27-9c4b-c8c300d27d66","year":2021},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.311055Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:4a2bc3f65b2ddb59b91d7fa844e41491aa4b3cdadce4f45078d7b1e1c6b32648","observation_id":"d84d0101-5df3-4618-bc73-b038fcf7aa60","resolution":{"observed_at":"2026-08-07T05:47:10.483219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-07T05:47:06.315314Z","title":"Ganguli, L","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.315314Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:f5bd4f6c491580ff17ee697397625a6807f0345fa5c98c16eb71a4088277f26c","observation_id":"530324e5-243d-475f-befc-a84336070e06","resolution":{"observed_at":"2026-08-07T05:47:06.315314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11654","last_updated":"2024-06-17T15:36:14Z","snapshot_observed_at":"2026-07-06T18:32:15.404516Z","submitted_at":"2024-06-17T15:36:14Z","title":"Ruby Teaming: Improving Quality Diversity Search with Memory for Automated Red Teaming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11654","snapshot_observed_at":"2026-08-07T05:47:06.319531Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.319531Z"},"links":{"cited_paper":"/paper/2406.11654","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:858b371421f5873df9615e5fa80829a17a8cf494dcea07fbd99397488c1acc63","observation_id":"67abd309-4205-47e6-bbf7-6df6236cdd2e","resolution":{"observed_at":"2026-08-07T05:47:06.319531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:10.265041Z","title":null,"venue":null,"work_id":"1c04f697-59ec-45ab-804b-60ff095d64d4","year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.323525Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:5565e5825842b035b2d245816fea21d6e3f964285fdf9d189396873e3835a0c3","observation_id":"e8e1e330-dff1-4996-84b0-4a610fefe98f","resolution":{"observed_at":"2026-08-07T05:47:10.337393Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:10.108751Z","title":"Hughes, M","venue":null,"work_id":"ad5e4c99-7747-4534-b3c6-f313218bfd56","year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.327536Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:18cc3d870b233463ec0a86b660cead77a001e70101edee82919a522acb4cfe13","observation_id":"69f05169-049c-45a3-aa90-a5357d94ac72","resolution":{"observed_at":"2026-08-07T05:47:10.187505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T05:47:06.331292Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.331292Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:d9ca4a6094087ae3fca1f2596586dd8b9cc080bb1e86e922e3f41a8dbdded279","observation_id":"ff8c9001-6c80-4574-b97e-7e4483d26373","resolution":{"observed_at":"2026-08-07T05:47:06.331292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:09.977959Z","title":"Kumar, A","venue":null,"work_id":"ff43100d-f89c-4211-a074-b765f6f18b26","year":2020},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.335521Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:c7bce8eb363ca4509c7d9b9c7398b6e29801886b59cf4d67ee33f6ed24f2fe27","observation_id":"d8e680d1-4ce1-468d-b82e-3c41893cc558","resolution":{"observed_at":"2026-08-07T05:47:10.057237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17444","last_updated":"2023-05-27T11:00:15Z","snapshot_observed_at":"2026-08-04T18:01:36.540422Z","submitted_at":"2023-05-27T11:00:15Z","title":"Query-Efficient Black-Box Red Teaming via Bayesian Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17444","snapshot_observed_at":"2026-08-07T05:47:06.339321Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.339321Z"},"links":{"cited_paper":"/paper/2305.17444","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:bf224501c59f43137b40ddcb4b74a68523de05448e210dd564d80642b3eebee4","observation_id":"ed031ec8-5f5e-4a6c-ae71-2b8dc591856c","resolution":{"observed_at":"2026-08-07T05:47:06.339321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:09.842000Z","title":null,"venue":null,"work_id":"3f1ed44c-c534-4b3d-aa36-db4c43c7d53c","year":2025},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.343332Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:aba7f13b48455ba9b1fedc4300badfb336661a6ac09328bd42502a1604079298","observation_id":"368b3530-a080-421b-973c-f6a3a13ebf21","resolution":{"observed_at":"2026-08-07T05:47:09.921799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:09.657088Z","title":"Lehman and K","venue":null,"work_id":"38637f43-0f80-4d1e-bcf0-c7c73ee0a7d8","year":2011},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.347223Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:50a397ee87fe9ef1598147f84d5d9df67eea112ee7002df8dbb6ca20c37a9b13","observation_id":"55b360fb-1dc4-4a5a-b6d5-97abf34106d2","resolution":{"observed_at":"2026-08-07T05:47:09.753027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:09.507300Z","title":null,"venue":null,"work_id":"a1f7cccb-03cb-4136-932f-46153104137d","year":2025},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.351079Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:b8cbb1f92bb8905f73f6490c45d2d57a8ec1c816e756fb298efd2077a89bf7ba","observation_id":"0e16e9b9-30c1-4e9d-8bb6-84233b388f8a","resolution":{"observed_at":"2026-08-07T05:47:09.561224Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:09.339627Z","title":null,"venue":null,"work_id":"f94231df-7dcd-4e1e-9901-53cad8c8a664","year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.354960Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:f9f8fa1ada7cf2b85c9dd67f09a9fe10ce19112bc1c8203e16f256d887e66c07","observation_id":"488a8623-4496-4674-bcc3-be9a4e926901","resolution":{"observed_at":"2026-08-07T05:47:09.422246Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:09.098810Z","title":null,"venue":null,"work_id":"f0760e39-98b4-4d10-976b-a84c4e32e9ac","year":2025},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.358905Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:3c4e14e599aae817b04fb5be7540b3ebacc3d5125a1c35034e9fcf8c5fa2cc8b","observation_id":"f7aba010-979d-48e2-b4b0-bebcb28285a6","resolution":{"observed_at":"2026-08-07T05:47:09.189626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05295","last_updated":"2025-04-22T05:20:39Z","snapshot_observed_at":"2026-07-06T19:29:14.335016Z","submitted_at":"2024-10-03T17:59:01Z","title":"AutoDAN-Turbo: A Lifelong Agent for Strategy Self-Exploration to Jailbreak LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05295","snapshot_observed_at":"2026-08-07T05:47:06.362862Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.362862Z"},"links":{"cited_paper":"/paper/2410.05295","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:249ab8cbbe1784f681864b823b23fa8a1858245d4555bc17ea67e0488a9d5fc6","observation_id":"04f9bc7a-20fe-4c09-bab5-2efced5b5b29","resolution":{"observed_at":"2026-08-07T05:47:06.362862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01830","last_updated":"2025-01-03T14:30:14Z","snapshot_observed_at":"2026-08-03T11:54:32.402984Z","submitted_at":"2025-01-03T14:30:14Z","title":"Auto-RT: Automatic Jailbreak Strategy Exploration for Red-Teaming Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01830","snapshot_observed_at":"2026-08-07T05:47:06.366957Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.366957Z"},"links":{"cited_paper":"/paper/2501.01830","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:31f96115483d3fd279f7febc845cd618f6f4abca74813ceb04e70b6edf30129f","observation_id":"c72098f9-5c78-41b4-9fcf-a7936fadf178","resolution":{"observed_at":"2026-08-07T05:47:06.366957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:08.977717Z","title":null,"venue":null,"work_id":"316de84f-d259-477c-b3f2-15a4fe7823c7","year":2022},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.370604Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:d01574aa31d19eec58c8deba43e67a1e9697860bd43ae144366386f9ea40bcf1","observation_id":"d4cb2434-aa2d-4e28-9106-4728fbd7ac27","resolution":{"observed_at":"2026-08-07T05:47:09.066532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1504.04909","last_updated":"2015-04-20T01:17:00Z","snapshot_observed_at":"2026-07-06T04:15:24.342522Z","submitted_at":"2015-04-20T01:17:00Z","title":"Illuminating search spaces by mapping elites","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.04909","snapshot_observed_at":"2026-08-07T05:47:06.374005Z","title":"Mouret and J","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.374005Z"},"links":{"cited_paper":"/paper/1504.04909","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:c267466cc7a9401517e83efd82a87f6ff9240786594dab43faddcd4a8f3be938","observation_id":"7cb49e18-6e4a-4b11-9cf0-c643e13bfec0","resolution":{"observed_at":"2026-08-07T05:47:06.374005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T05:47:06.378195Z","title":"Achiam, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.378195Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:71d15d7d6e4222c609d7218da2340fcaf011ad07fff339482d4f5bbfde3dfc04","observation_id":"d976701a-ec82-472e-a490-91d55c6aa501","resolution":{"observed_at":"2026-08-07T05:47:06.378195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:08.866848Z","title":"Ouyang, J","venue":null,"work_id":"584adf95-624b-4879-be63-646ffba19b84","year":2022},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.381808Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:2ac9b6385ea4a3198f6f10fafe6a643ef76b6241e32e5d112040086602617650","observation_id":"da3ece7e-93ee-461a-82f1-c75409396c59","resolution":{"observed_at":"2026-08-07T05:47:08.909815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10701","last_updated":"2024-08-20T09:58:01Z","snapshot_observed_at":"2026-07-06T19:03:22.586506Z","submitted_at":"2024-08-20T09:58:01Z","title":"Ferret: Faster and Effective Automated Red Teaming with Reward-Based Scoring Technique","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10701","snapshot_observed_at":"2026-08-07T05:47:06.385682Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.385682Z"},"links":{"cited_paper":"/paper/2408.10701","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:90466c1dfb340e4ee7743abf6e2894bba956258b719e672aced5756bcbe9cf61","observation_id":"557819b9-5963-4546-9936-3f57596b3bf7","resolution":{"observed_at":"2026-08-07T05:47:06.385682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:08.680903Z","title":"Papineni, S","venue":null,"work_id":"52784b74-0465-4938-b4c8-44c22775b56b","year":2002},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.390076Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:11998365f53eb42fb2bc030e1091af0438195e747dd988a39c65b3d6fdbfce7b","observation_id":"b5577420-bbba-4584-bd19-2040614556f2","resolution":{"observed_at":"2026-08-07T05:47:08.749818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01606","last_updated":"2024-10-02T14:47:05Z","snapshot_observed_at":"2026-08-03T19:54:21.584740Z","submitted_at":"2024-10-02T14:47:05Z","title":"Automated Red Teaming with GOAT: the Generative Offensive Agent Tester","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01606","snapshot_observed_at":"2026-08-07T05:47:06.393841Z","title":"Pavlova, E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.393841Z"},"links":{"cited_paper":"/paper/2410.01606","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:14d6b0f352a0a93d0e047fbf905b9ad8aad81d24e5f90ea95c3b5e59f467fcc6","observation_id":"a3ccd036-9131-4919-a898-91b51e385d9a","resolution":{"observed_at":"2026-08-07T05:47:06.393841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:08.555151Z","title":"Perez, S","venue":null,"work_id":"d6502c52-3911-4e66-b138-dcddd0999b7d","year":2022},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.398370Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:9e7a3c295981882757b903d28f82fb2fe4262717be3681bc06d7fe1406e74eae","observation_id":"db8f2b4a-8f03-4df1-b33e-e7dcaf7024d8","resolution":{"observed_at":"2026-08-07T05:47:08.595811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:08.414283Z","title":"Pierrot and A","venue":null,"work_id":"f262dee5-7ad9-4112-8a3b-e4cd9f662dbe","year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.402412Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:1715085526515950398696b7dc9189570b9e8a9550404e6cc272b8358412b921","observation_id":"79e32fbf-0d62-4208-9e5f-347d2531b2d5","resolution":{"observed_at":"2026-08-07T05:47:08.455692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:06.405858Z","title":"Radford, J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.405858Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:1c08df9b3427d14a51d3686e549121e0d0bcb6bb843e19bb6cde4b2f2bc38a5e","observation_id":"f31cb81d-0f12-40b3-95da-a498447ae0a3","resolution":{"observed_at":"2026-08-07T05:47:06.405858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-07T05:47:06.411541Z","title":"Samvelyan, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.411541Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:2d61cd187f17d82c550e7fc0ba558ab37e846d0befad756dd14d015dd785aaf4","observation_id":"218d1088-3bf5-40a8-8729-f2bc379ba839","resolution":{"observed_at":"2026-08-07T05:47:06.411541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T05:47:06.424963Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.424963Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:b5c7bcdabd4601db26003f7b570bda5e0fd558d2762b6a02030146a45f0f42b6","observation_id":"8fd6be47-9214-47cc-ba8d-bbc49e7eee8e","resolution":{"observed_at":"2026-08-07T05:47:06.424963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T05:47:06.433915Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.433915Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:83f185ac88c1727f6cfacd9f870bc8da8ecf28bf252088b727e2a0d4ec0fb2d0","observation_id":"aa003bf7-7c74-4f60-ac57-1a6d6c191ee5","resolution":{"observed_at":"2026-08-07T05:47:06.433915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:08.258331Z","title":"do anything now","venue":null,"work_id":"948390cb-613f-4b50-937a-0993075e2dea","year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.443379Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:046915fb9dd96970657c7ab12c4acf8c48eb9d9322898599b72d6f7588d12beb","observation_id":"e1aa7f07-83e0-4968-be05-3ce270093c46","resolution":{"observed_at":"2026-08-07T05:47:08.304003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:08.091725Z","title":null,"venue":null,"work_id":"547e81cd-40f3-4be5-aace-7ab561691879","year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.450960Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:4354fc2202893bbd0e0c842c6f315ba46b6f6137b3b1313630efd415ea5868af","observation_id":"0100c8d6-5657-42ae-b12b-32b884030d30","resolution":{"observed_at":"2026-08-07T05:47:08.193528Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T05:47:06.458934Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.458934Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:a4f919efa0fa28dbbe260bbb06189d6e44c4c62d61a29a624c0348b262bb5d14","observation_id":"6a347ce3-01f3-4f55-94f3-36a0c335e24b","resolution":{"observed_at":"2026-08-07T05:47:06.458934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:07.933740Z","title":"Tjanaka, M","venue":null,"work_id":"944760b9-dc68-4e46-9c96-798b7f136b4c","year":2021},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.468221Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:df6ae52796064cf35718e09846bf6e4a58ec295f4b5ffb713a1e31f6157eb093","observation_id":"2cafc167-6944-42ee-90f1-3ff624017879","resolution":{"observed_at":"2026-08-07T05:47:08.037276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:07.791136Z","title":"Tylkin, G","venue":null,"work_id":"f8b030f5-3a11-4167-83cc-d3ff1993e657","year":2021},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.477058Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:ddef45d9531c70e9b9a6a5689ef8084e6820e20d854db479363a97f5f5d8fbe4","observation_id":"f2678370-4881-4a30-891d-7edee253b3d9","resolution":{"observed_at":"2026-08-07T05:47:07.862758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15585","last_updated":"2025-06-09T02:36:20Z","snapshot_observed_at":"2026-08-07T16:00:23.244876Z","submitted_at":"2025-04-22T05:02:49Z","title":"A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15585","snapshot_observed_at":"2026-08-07T05:47:06.486187Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.486187Z"},"links":{"cited_paper":"/paper/2504.15585","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:61682bb594f44a1eba50463815a2086985333349380bbde98f97a13e8fd3bfaf","observation_id":"17b4c414-b8f2-4f89-9b36-58b936c31ebc","resolution":{"observed_at":"2026-08-07T05:47:06.486187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:07.644758Z","title":null,"venue":null,"work_id":"d7933c71-b833-4914-94b8-90f2ea23fe86","year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.495349Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:cb480aa3d5d08c933b69fb5edcacc042eb25e03789b4a1985a113c2de1589fc1","observation_id":"6ec8586b-9385-4b74-aa5d-c511cf6c4497","resolution":{"observed_at":"2026-08-07T05:47:07.714583Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-07T05:47:06.503637Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.503637Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:6e277d6ca924fe99c5573d0e615b19d28808de3a4707259f81fb1ce1d49e3c83","observation_id":"4ec1c18d-206d-45a6-ad1b-233c7e70c5d4","resolution":{"observed_at":"2026-08-07T05:47:06.503637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T05:47:06.512232Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.512232Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:097d9733e21143f992f8f4aada42cfa12bb4ea012e6a2557755dfeb24a9e0f78","observation_id":"c381b726-213a-42a9-be42-bf64e4373be7","resolution":{"observed_at":"2026-08-07T05:47:06.512232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-04T23:34:13.332065Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04295","snapshot_observed_at":"2026-08-07T05:47:06.519986Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.519986Z"},"links":{"cited_paper":"/paper/2407.04295","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:a549f96885578f309ccb6898fe480e9dbcbe08c9d2bbec2be05bc41c718f5a49","observation_id":"44872646-10ab-4b21-9d3f-d600164ae6ac","resolution":{"observed_at":"2026-08-07T05:47:06.519986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:07.461022Z","title":"Zhang, M","venue":null,"work_id":"6c55efad-379e-4250-b096-bc20a0c9f43f","year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.527429Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:0090cea134c10671617d528e6b2abd5f389e059b5eec9370e418cff95c70c006","observation_id":"97c1b789-3bbd-4074-8f5e-acaa3d9a555c","resolution":{"observed_at":"2026-08-07T05:47:07.527212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:07.229799Z","title":null,"venue":null,"work_id":"8be038fd-e64d-4c0a-8b8f-5c09105351b1","year":2019},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.534422Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:637fd40301858fad09b19f734f0c902d393493f2d9ed2585db33a9b31a321bd2","observation_id":"9a4fddd6-7ee6-4d2a-9fe5-9bdb2a657612","resolution":{"observed_at":"2026-08-07T05:47:07.339102Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:07.050360Z","title":null,"venue":null,"work_id":"fbb2478f-093f-41a9-b82b-7bcd4bbad430","year":2018},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.542929Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:6c3bdb81b808b7aa373d85c0cbd0eb1dbf9142f6b3ab2b0f2ad129487fa921bd","observation_id":"4a7bd24f-b2a6-4b45-a13e-66e0446f7c67","resolution":{"observed_at":"2026-08-07T05:47:07.124321Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T05:47:06.550282Z","title":"Limitations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.550282Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:d0a9763f5487e0f9af6cf2f79cc27d4448d6f57a0a3e9a2ddbc878f22b972993","observation_id":"c5b5dccf-b483-434d-84e9-7e16181e91d6","resolution":{"observed_at":"2026-08-07T05:47:06.550282Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:06.884223Z","title":"revolu- tionary","venue":null,"work_id":"965fa3b8-7b35-4e21-b0e8-ee941764f766","year":2025},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.558987Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:11b3b4418ab27f85b61e93706ef206820e62b36e6d78530fcf7c07fb43a9216f","observation_id":"69616bfa-3378-4970-bfeb-f21938809c11","resolution":{"observed_at":"2026-08-07T05:47:06.947336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 2 inbound Pith citation observations for arXiv:2506.07121."}