{"as_of":"2026-08-07T04:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2e704a6c387e13d20516a8c6fa5497b3ca32ce6c9a33718072ff074980807f50","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T16:28:45.017930Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.09701/citation-record","integrity":"/paper/2606.09701/integrity","json":"/paper/2606.09701/citation-record.json","paper":"/paper/2606.09701"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.13026","last_updated":"2026-07-23T13:46:08Z","snapshot_observed_at":"2026-08-04T03:47:42.431299Z","submitted_at":"2026-03-13T14:34:54Z","title":"PISmith: Reinforcement Learning-based Red Teaming for Prompt Injection Defenses","version":2},"cited_work":{"arxiv_id":"2603.13026","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.13026","snapshot_observed_at":"2026-07-24T02:23:53.717099Z","title":"Pismith: Reinforcement learning-based red teaming for prompt injection defenses","venue":null,"work_id":"6106df99-e843-4005-92b1-2a7851b0d981","year":2026},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"cited_paper":"/paper/2603.13026","citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:f147dcf1b586e6800fbddb28c0ff4d2877233a5f7155c70b3cfed02db7f71a48","observation_id":"bc40a83d-e24f-4c68-ba9d-f55933afd621","resolution":{"observed_at":"2026-07-24T02:23:53.717099Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:4bca11a87578f770fa412f81c6121e45ddd1a984c88f3fe8555259f18cd1ef9d","observation_id":"bfcb45f3-893a-4583-bdb5-bbb2b273198d","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-025-09422-z","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T03:06:43.562716Z","title":"doi: 10.1038/s41586-025-09422-z","venue":"Nature","work_id":"9835b482-5032-4135-93dd-82a066677569","year":2025},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:e4c78d0329cc11dab5e036a4653a3c208aca83729e40b75ed15b3551991a9522","observation_id":"007187ce-59bf-44bb-aa28-f450c4fe12cd","resolution":{"observed_at":"2026-06-27T16:31:02.062491Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-03T22:08:21.094896+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T22:08:21.094896+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:df5b1a9d0d2c8efe143b751d9ec73785a78711cc8aad55d1938455809f935456","observation_id":"2c5a317f-d912-4688-b608-265afa12644d","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:b163ece97dff237f420aa04ba7505997181c8d280d5d177d283c325b758686ee","observation_id":"0f0cc40f-96d4-4f99-8282-473948a52bf1","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:1fcfc3e8b7156c43adc263931c23de899ff25888a77a0e62bb141338bfa4419e","observation_id":"06212a62-c280-4935-aa65-c3a475a963d5","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:e103dd840e109096451dea7f7f425fafcf7a5e27c112b526705f667a0efbb605","observation_id":"1afb594f-26da-4c38-aceb-0b837d0d7dae","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:d640a771adb9a9a631f0d57ac717c75a20b4ee6bd8e1c9343026ddd14b42584b","observation_id":"f4542dc8-b047-4a5b-9585-5ac5d851617b","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:d27604158309b33421f706e731cb908618e5702ca773397d3bed80657bc8c166","observation_id":"4a5f48ab-11dc-4c44-8596-bd1f5bd78a61","resolution":{"observed_at":"2026-07-03T01:27:31.634778Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":"2305.18290","doi":"10.48550/arxiv.2305.18290","metadata_source":"pith","pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","venue":"cs.LG","work_id":"62105b61-411f-46e5-970a-bd322c6adbbc","year":2023},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:ea6a958acca798ffa39e3af668437c352369aefc7fc8582f1be476249455c35f","observation_id":"18e0e604-868a-403d-8f61-bac452f50059","resolution":{"observed_at":"2026-07-03T01:27:31.639622Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:53:49.179087+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:53:49.179087+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":"2209.07858","doi":"10.1136/bcr-2013-201554","metadata_source":"pith","pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","venue":"cs.CL","work_id":"1aabd84d-3779-4ba9-ba2f-15ce264a9b1e","year":2022},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:0babbb72ea71a5a9c3908731c716a18c22ffbfdef4df3bff5517748fa303e5c5","observation_id":"040d9f00-d93b-4005-8405-8c9e808d21d6","resolution":{"observed_at":"2026-07-03T01:27:31.632119Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":"2307.15043","doi":"10.48550/arxiv.2307.15043","metadata_source":"pith","pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","venue":"cs.CL","work_id":"3322fa86-1768-4677-8425-dd326b45e078","year":2023},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:997d49b3faca2725fff4da34cbad81a41b1af5af7060d6d008377bbd166db9bf","observation_id":"a60b8832-343f-4735-8be8-2f4d405a5b5e","resolution":{"observed_at":"2026-07-03T01:27:31.629610Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:b9240d58cadcf1fff0d5362d2bca251905bb0b1bbd2cb70709a44063e4474c25","observation_id":"1ae5feb5-f481-4a13-ac88-a3d7afcc6bd9","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"Proceedings of the 2024 Conference of the North American Chapter of the Association for Computational Linguistics , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:199097586c076f26f3cccae69dcd10404ea55cb7655dc7536d8abb3671d92cd3","observation_id":"2700a66a-368d-4d69-b561-99ce157d13c5","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:fc55d34246651a04b7b6feee53bf08ac9b5ca053ca978b1c6344b42ee2635f3c","observation_id":"c3006e1c-116d-4dde-a98f-750032cf7943","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"Great, now write an article about that: The crescendo multi-turn","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:8893afe5c36298af8e6484e3408cbd591280d8a1cf269f9f87c8727539333c8e","observation_id":"ce2a52c5-c8c1-48d7-9857-efd5cfcbdb4b","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03286","last_updated":"2022-02-07T15:22:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-02-07T15:22:17Z","title":"Red Teaming Language Models with Language Models","version":1},"cited_work":{"arxiv_id":"2202.03286","doi":"10.48550/arxiv.2202.03286","metadata_source":"pith","pith_arxiv_id":"2202.03286","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Red Teaming Language Models with Language Models","venue":"cs.CL","work_id":"d1274c54-508f-42f9-aeb3-91db13f3a622","year":2022},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"cited_paper":"/paper/2202.03286","citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:3b227d3aeee376635436da831463f3f9b9a16b67ba548ce499708da836c637e0","observation_id":"c08a03ff-57dd-48a5-aaa4-b3199d638e56","resolution":{"observed_at":"2026-07-03T01:27:31.637181Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:4846c48ac0701010661d1b3bc3441005eb1ddf742b8d786a4420a5e5992c52b5","observation_id":"c5ccd1d5-c6a6-425a-b51b-f648313a6152","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:0fcfc6ec58967caf65f93c811e7d8a4a09cc2b8ea79420abd80cb7bdfd032c3f","observation_id":"f20a1017-1b0c-4255-a7cb-e3c918f7ac11","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:ed962299415e4b5f3788def91420e2a499f902a945b46b34fdf01a431fcdd42b","observation_id":"a3eeb44d-a76f-4d09-8b41-fbd0529fe781","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:c1ffaeab8c8380a0d3e987ff7010300fa902da2ec11e41fcf6ae6000ac43fda3","observation_id":"2e166221-f2a9-4214-a744-7179a86a18cc","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"and Singer, Yaron and Karbasi, Amin , journal=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:c8f673c81b99e408a0dff62f85249e881384b704a19183ac508a6d7f4357b032","observation_id":"781265a4-1662-4d4a-aef5-9320da7cc225","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":"2310.08419","doi":"10.48550/arxiv.2310.08419","metadata_source":"pith","pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","venue":"cs.LG","work_id":"38678cda-6595-4ca3-916b-066c00cce063","year":2023},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:d2fff3b4545f215267f2a6b019c6d2fbc88eb52a0e98f4a1f1e5ee2f0b8b4def","observation_id":"16b99920-c58f-4223-bb95-97db85101993","resolution":{"observed_at":"2026-07-03T01:27:31.626972Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:06.618013+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:06.618013+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:8fa1e2def31961a38cb879c8909ee056279088ec567ea57cb55444533c53338b","observation_id":"a2c843c4-498b-45a6-9034-5a5b46fde3a2","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:95c97207b1918921cb18d473619dfdb3a4fe56f09366a54432c60b2fb9cbf2fd","observation_id":"0c05c7bd-1367-4910-ac1b-cd8da3877b31","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:9000c86e321d481323160cc8d60f60dba8e78e9d580671a5c6935f9494494e09","observation_id":"0157ab3d-9d3a-4f2c-98f5-a8d0d2f92055","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"Do Anything Now","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:6ca9717b29f44ce82bf2ac59b07999a437754707d3e805844f76a547a5fbcfb9","observation_id":"b6f9b626-ed2e-4f6e-87e3-a232d10a0bee","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:6f623a899274c467a1150d9e1ee8e89811401029845b21d3eadf632befdbabfe","observation_id":"594097f8-ea83-49ad-8aa6-ce56e88c50ee","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:e0e94f72cc6843b49ed40022ecc120bfe99eb54766fda72e08e277777435ee60","observation_id":"7557f243-f665-4019-ac4d-c4ef2edbff8f","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:5582d4afa0571b1dd4f3168dc6bba0aeba58ed5e0a74822c691be80471080cbc","observation_id":"cb99a591-b896-41c6-8f4d-7e4a0172392c","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:36dd6669d54cea265bacf15e30cc5a459905de421415bd401808b5ee341879b4","observation_id":"eac1b86f-ebb6-4144-b00f-ed6deeadb1d6","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:38d7871465c96e1a2678da22eeb595c565efddb3c5a636c79ae36e5662f7d7a9","observation_id":"6c129ae5-d289-42f5-9652-a451efdb158b","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:6800af0c84ad326390118781ebf7db069ba38fa0ac8c25184dfc943e59b309d6","observation_id":"9165e03d-ae0c-4c7e-aebe-41f26d1a5eb9","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:30e88c70992f75f52cb278c534cd1471b88623ba47483fec4ee80c0e24f74229","observation_id":"c2ac2712-48fe-4547-8c2a-c6944f981680","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-4322","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Arditi, O","venue":null,"work_id":"cb381a59-c4d3-41cd-8a7e-fdbb1b08fcf1","year":2024},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:7abe403202fd3bf701e0207b8f3d57b1dc31b67e09fccf17571921a9d9e8672d","observation_id":"78e94437-501e-4dc7-81a2-0cc1744643b0","resolution":{"observed_at":"2026-06-27T16:31:02.065302Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:5237468c3fc3106d08bfc75195ccd04b0aad66409bb0e2207994b0fdc110b2a6","observation_id":"519b2a57-6f0d-423d-9c47-31e088cbe46e","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"Break-Fix","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:3d6ecab330844183785b0c4a226fa80f2b4b5781150e2d068709163857c157e2","observation_id":"d6c9f497-62fb-4936-bf4b-625ddbba4891","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:80efee73c65f91119d69c09dc5e9d1ad215fc7e1efff5301b07b55dedea7871c","observation_id":"67f3e782-574a-49b1-9b28-2cbde17a08a6","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:b7e1aafdae39773f985402dc3922369ea557fc07f4262f8999aeaf52aa8e919a","observation_id":"ed5d607f-37e2-417f-b6ab-8e962bf2a240","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:32c5f8009ee7974e2d1b502184ce1f3b798057fb509e097fd209fa50a640dc9d","observation_id":"7aa63efb-b97a-42c0-bcfb-b4169791eb60","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2018 , eprint=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:b84414de2786e6a27d2855d141747b9eabc01efa44dbb5bc31cd7ebfa86acef0","observation_id":"a08d829d-3b26-42e9-8fb5-ac21b8cb5553","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:2f750aa6cf546318f58b54ba8a4415883b27ddde0f4e9d10d651a30513c7c12d","observation_id":"eb1d2193-c3d3-439f-a179-7cb377cba55f","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:19d8cc26d03b89097c112e62cf7b8e72018328853d502107941e4c259953d8ad","observation_id":"5ff5fa8e-c25b-41e7-8602-d0b483c10145","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T16:28:45.017930Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-27T16:28:45.017930Z"},"links":{"citing_paper":"/paper/2606.09701"},"observation_digest":"sha256:0a9668ec378cdb4e342cd81a11b8780dfe5e7c23553b9ed9a62ccfa5359a70ce","observation_id":"784b63c2-49b4-4452-b110-fa8c89060b2f","resolution":{"observed_at":"2026-06-27T16:28:45.017930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.09701","last_updated":"2026-06-08T16:21:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T03:48:36.086186Z","submitted_at":"2026-06-08T16:21:36Z","title":"Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":8,"parse_uncertain":0,"unresolved":35,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2606.09701."}