{"as_of":"2026-08-07T09:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:49661bf9ffee4511fa3d063068d605137d7dbb5e942d63e5dae6cf90feaa7d47","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T01:16:15.489997Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.00134/citation-record","integrity":"/paper/2608.00134/integrity","json":"/paper/2608.00134/citation-record.json","paper":"/paper/2608.00134"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-04T01:16:09.264836Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.264836Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:ce6d912e5cb84572e91a8b58993ead9d54058c53947087cd7e6558d14003213d","observation_id":"798a21b2-7217-4fa7-b796-04582796ca4b","resolution":{"observed_at":"2026-08-04T01:16:09.264836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-04T01:16:09.358040Z","title":"Gemini: a family of highly capable multimodal models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.358040Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:84aeb228f27ff6c10239945c001d52ee745c7bb2a75f8be9fc17f724123d31fd","observation_id":"7e9400a6-d005-41c6-add6-9971e971b577","resolution":{"observed_at":"2026-08-04T01:16:09.358040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-04T01:16:09.397390Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.397390Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:019e87f1e56dede5f99aa8f07f9302f357be3b46f1a321b4e91e95b9d89f32e0","observation_id":"197cda93-1f6e-451b-ba6b-589f4480435f","resolution":{"observed_at":"2026-08-04T01:16:09.397390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05112","last_updated":"2024-07-22T12:16:30Z","snapshot_observed_at":"2026-07-06T16:45:03.211791Z","submitted_at":"2023-11-09T02:55:58Z","title":"A Survey of Large Language Models in Medicine: Progress, Application, and Challenge","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05112","snapshot_observed_at":"2026-08-04T01:16:09.467147Z","title":"A survey of large language models in medicine: Progress, application, and challenge,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.467147Z"},"links":{"cited_paper":"/paper/2311.05112","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:46c62a63b5750b63cfdc7c2efffa191b9913e535534e6f8fe3762e1a847a0ac2","observation_id":"1afd53bc-d838-4a72-8bd4-2cb3df258454","resolution":{"observed_at":"2026-08-04T01:16:09.467147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04199","last_updated":"2023-11-07T18:39:10Z","snapshot_observed_at":"2026-08-04T12:12:27.160989Z","submitted_at":"2023-11-07T18:39:10Z","title":"Exploring Recommendation Capabilities of GPT-4V(ision): A Preliminary Case Study","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04199","snapshot_observed_at":"2026-08-04T01:16:09.515819Z","title":"Exploring recommendation capabilities of gpt-4v (ision): A preliminary case study,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.515819Z"},"links":{"cited_paper":"/paper/2311.04199","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:91a0b66c51a599bd49186e85176494177612f462cd8525288cc3beef5e973d54","observation_id":"155f7a77-09a2-4a6b-b4de-b421612b25a3","resolution":{"observed_at":"2026-08-04T01:16:09.515819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:09.563310Z","title":"{LLM-Fuzzer}: Scaling assessment of large language model jailbreaks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.563310Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:c96dc9d21b6b1355660c7102e75668554be7b166ec5253f3a610e0be77aaa2e4","observation_id":"d1e15201-e534-458f-aad3-c61eaa37143d","resolution":{"observed_at":"2026-08-04T01:16:09.563310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08615","last_updated":"2024-12-16T04:05:45Z","snapshot_observed_at":"2026-07-06T20:05:28.003434Z","submitted_at":"2024-12-11T18:37:56Z","title":"Exploiting the Index Gradients for Optimization-Based Jailbreaking on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08615","snapshot_observed_at":"2026-08-04T01:16:09.626615Z","title":"Exploiting the index gradients for optimization-based jailbreaking on large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.626615Z"},"links":{"cited_paper":"/paper/2412.08615","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:06caf8b2f070b2f98df8d9c96e342fac626f93820a24ed223ee8770bc0561c29","observation_id":"bb0cadd4-0fc1-4fa6-ba87-396222896a5e","resolution":{"observed_at":"2026-08-04T01:16:09.626615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:09.673549Z","title":"Making them ask and answer: Jailbreaking large language models in few queries via disguise and reconstruction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.673549Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:d36a9fb7dc4d9e17536fdb8826461a0cab756f069908594d9157af86e40d2996","observation_id":"ab6b3cef-02ed-44c9-aa4b-6c404eb1e212","resolution":{"observed_at":"2026-08-04T01:16:09.673549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:09.743694Z","title":"Helping big language models protect themselves: An enhanced filtering and summarization system,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.743694Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:56839740ea10408a55a6d893881e2e272704ec44cb36797f968c8d5afd01a668","observation_id":"986c3a0b-3af2-4f0f-9beb-c9e6bdff0a39","resolution":{"observed_at":"2026-08-04T01:16:09.743694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13203","last_updated":"2025-08-23T02:09:57Z","snapshot_observed_at":"2026-07-06T21:11:10.415720Z","submitted_at":"2025-04-15T16:11:28Z","title":"X-Teaming: Multi-Turn Jailbreaks and Defenses with Adaptive Multi-Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13203","snapshot_observed_at":"2026-08-04T01:16:09.808925Z","title":"X-teaming: Multi- turn jailbreaks and defenses with adaptive multi-agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.808925Z"},"links":{"cited_paper":"/paper/2504.13203","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:8973482dd34343fa3bf2fb13c75dc6d44bf5ccf9ffe0a30181ac08c01c15c9d0","observation_id":"404c6bc3-e694-4d71-8157-9785c1c560ff","resolution":{"observed_at":"2026-08-04T01:16:09.808925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06987","last_updated":"2023-10-10T20:15:54Z","snapshot_observed_at":"2026-07-06T16:30:46.321160Z","submitted_at":"2023-10-10T20:15:54Z","title":"Catastrophic Jailbreak of Open-source LLMs via Exploiting Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06987","snapshot_observed_at":"2026-08-04T01:16:09.952167Z","title":"Catastrophic jailbreak of open-source llms via exploiting generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:09.952167Z"},"links":{"cited_paper":"/paper/2310.06987","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:1c150347913545a24ef079c19551e041674871e62b656fc9a8ddb37c4df0fd6f","observation_id":"42419e43-111b-46b5-987d-646f2b11d314","resolution":{"observed_at":"2026-08-04T01:16:09.952167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:10.059041Z","title":"Datasentinel: A game-theoretic detection of prompt injection attacks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.059041Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:236eafbbfd949b1fd6232688003d2cb93d6a5a34823a51f650b1fb23883b93ca","observation_id":"37abdc89-91e0-4d96-b872-5b08253372c3","resolution":{"observed_at":"2026-08-04T01:16:10.059041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-04T01:16:10.099322Z","title":"Jailbreaker: Automated jailbreak across multiple large language model chatbots,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.099322Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:be379867b97f04a3b64a80683e3cb3cecc05f46192cf306e815100aeaae83ec9","observation_id":"d9fddcb5-449b-45cc-b026-56190ae5a93b","resolution":{"observed_at":"2026-08-04T01:16:10.099322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:10.155570Z","title":"Fight back against jailbreaking via prompt adversarial tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.155570Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:d7db7e510a986e8ead7236e1c6933039134c01eecf4452c81924d092eb4e5cfc","observation_id":"61e51d5b-99a8-4d04-bdca-02bb060bf374","resolution":{"observed_at":"2026-08-04T01:16:10.155570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07875","last_updated":"2024-03-19T16:50:50Z","snapshot_observed_at":"2026-08-06T23:45:57.910675Z","submitted_at":"2023-09-14T17:23:37Z","title":"Safety-Tuned LLaMAs: Lessons From Improving the Safety of Large Language Models that Follow Instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07875","snapshot_observed_at":"2026-08-04T01:16:10.204874Z","title":"Safety-tuned llamas: Lessons from improving the safety of large language models that follow instructions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.204874Z"},"links":{"cited_paper":"/paper/2309.07875","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:328aee024309bb9c65f03263a3b01d82f6b9fa538bddc0628f8348b2e13efe49","observation_id":"6b501988-70d3-46de-a021-4fa32eacd20a","resolution":{"observed_at":"2026-08-04T01:16:10.204874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:10.255483Z","title":"Distributional preference learning: Understanding and accounting for hidden context in rlhf,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.255483Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:8bfc5178ae467e3e2ac6dfd76fd9121a3846686c2e1b2b295cd5f855ed369086","observation_id":"7a4e43e2-0e5d-4de7-bdcb-23599c9c7c44","resolution":{"observed_at":"2026-08-04T01:16:10.255483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09154","last_updated":"2025-03-03T09:37:27Z","snapshot_observed_at":"2026-08-03T17:59:18.731227Z","submitted_at":"2024-02-14T13:13:26Z","title":"Attacking Large Language Models with Projected Gradient Descent","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09154","snapshot_observed_at":"2026-08-04T01:16:10.330416Z","title":"Attacking large language models with projected gradient descent,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.330416Z"},"links":{"cited_paper":"/paper/2402.09154","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:d08b2884cadaecf3fd4ba4d3c38da9ffe833ce324fe3c0549c782b03574c1252","observation_id":"c5232ba9-5422-459d-ba88-940486fce466","resolution":{"observed_at":"2026-08-04T01:16:10.330416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-04T01:16:10.406423Z","title":"Universal and transferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.406423Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:93b46d5d56f6727c795ddd5e4a14d108ae8020ef418bdcf2c778a3c0b64294b2","observation_id":"fa11cee1-adf0-4aaf-9489-059349dd9982","resolution":{"observed_at":"2026-08-04T01:16:10.406423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-04T01:16:10.469528Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.469528Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:ee635f6c8457fa29c9ee1cf79dcd4c54d888b60fce3dcf1386f83d6af4d9d049","observation_id":"0f7201d3-4551-4f8f-a646-d595f553792f","resolution":{"observed_at":"2026-08-04T01:16:10.469528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16873","last_updated":"2025-06-02T18:59:01Z","snapshot_observed_at":"2026-08-05T10:26:02.067012Z","submitted_at":"2024-04-21T22:18:13Z","title":"AdvPrompter: Fast Adaptive Adversarial Prompting for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16873","snapshot_observed_at":"2026-08-04T01:16:10.569808Z","title":"Ad- vprompter: Fast adaptive adversarial prompting for llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.569808Z"},"links":{"cited_paper":"/paper/2404.16873","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:a7804477db42a2337a262df88b7fec04435b95b8301fa416f4548843ae88bd8c","observation_id":"a36c6875-97c0-47a9-8bd8-25e0b0f97ecd","resolution":{"observed_at":"2026-08-04T01:16:10.569808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06373","last_updated":"2024-01-23T22:46:12Z","snapshot_observed_at":"2026-07-06T17:14:36.670116Z","submitted_at":"2024-01-12T16:13:24Z","title":"How Johnny Can Persuade LLMs to Jailbreak Them: Rethinking Persuasion to Challenge AI Safety by Humanizing LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06373","snapshot_observed_at":"2026-08-04T01:16:10.686916Z","title":"How johnny can persuade llms to jailbreak them: Rethinking persuasion to challenge ai safety by humanizing llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.686916Z"},"links":{"cited_paper":"/paper/2401.06373","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:6ce39802ba8f9692e97cbcd5d1b152da2ec3623afec76aebfd664cbfc3bd2b90","observation_id":"a37eead2-fe61-4568-bb8d-e8cebb9cacac","resolution":{"observed_at":"2026-08-04T01:16:10.686916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-04T01:16:10.758446Z","title":"Gptfuzzer: Red teaming large language models with auto-generated jailbreak prompts,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.758446Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:f584c22465053be0fe3db1426d54c067cef95e8516252b7a6eaf932ddba5cd68","observation_id":"15e36a56-ffb3-45ed-9880-b7a8ba38d7b5","resolution":{"observed_at":"2026-08-04T01:16:10.758446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:10.811489Z","title":"Honeytrap: Deceiving large language model attackers to honeypot traps with resilient multi-agent defense,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.811489Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:c338c7cd3d564d19976acc2db3ff958faaf4cbb7622a601133d0639ae0ddbd57","observation_id":"b286444e-f098-4bb3-affc-415bf51b6227","resolution":{"observed_at":"2026-08-04T01:16:10.811489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01833","last_updated":"2025-02-26T13:41:41Z","snapshot_observed_at":"2026-08-03T07:26:39.431128Z","submitted_at":"2024-04-02T10:45:49Z","title":"Great, Now Write an Article About That: The Crescendo Multi-Turn LLM Jailbreak Attack","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01833","snapshot_observed_at":"2026-08-04T01:16:10.875255Z","title":"Great, now write an article about that: The crescendo multi-turn llm jailbreak attack,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.875255Z"},"links":{"cited_paper":"/paper/2404.01833","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:a11410663ee4e71c48491ad46247d89eacb23ea08999b56ff3ed24cda7fec631","observation_id":"75924873-2eeb-426e-8578-a3e07ec5c661","resolution":{"observed_at":"2026-08-04T01:16:10.875255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:10.989189Z","title":"Tree of attacks: Jailbreaking black-box llms automatically,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:10.989189Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:b6af87b3d2adce4122f6f00c0ce91d139698a58f604b985e8004098d423dd807","observation_id":"f2c38328-d87e-4d06-bd39-e9b7c027bb6d","resolution":{"observed_at":"2026-08-04T01:16:10.989189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14866","last_updated":"2025-03-03T07:25:21Z","snapshot_observed_at":"2026-07-06T19:20:19.151388Z","submitted_at":"2024-09-23T10:03:09Z","title":"PAPILLON: Efficient and Stealthy Fuzz Testing-Powered Jailbreaks for LLMs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14866","snapshot_observed_at":"2026-08-04T01:16:11.117001Z","title":"Effective and evasive fuzz testing-driven jailbreaking attacks against llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.117001Z"},"links":{"cited_paper":"/paper/2409.14866","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:c0a19f91b41f411e8f6b73f7976f011b5c7f1ac8ec4199153e95bb5891d7c4c5","observation_id":"698e5121-2960-4aa4-a4cb-2b58e6633457","resolution":{"observed_at":"2026-08-04T01:16:11.117001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:11.197104Z","title":"” do anything now","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.197104Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:9ec2d1bdf9f9cbc18ea4d94c43d8175cd8527734e7076350c4319aeece6204f9","observation_id":"6b57bb15-a2bf-48a0-aead-4011b5f951a5","resolution":{"observed_at":"2026-08-04T01:16:11.197104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09324","last_updated":"2024-11-06T04:43:57Z","snapshot_observed_at":"2026-07-06T18:30:28.421247Z","submitted_at":"2024-06-13T17:01:40Z","title":"Bag of Tricks: Benchmarking of Jailbreak Attacks on LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09324","snapshot_observed_at":"2026-08-04T01:16:11.264145Z","title":"Bag of tricks: Benchmarking of jailbreak attacks on llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.264145Z"},"links":{"cited_paper":"/paper/2406.09324","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:a0efc2ca86496386fbd1bacd00c49a0521780b43608f54a3cd58cb81b4d92c14","observation_id":"1e0a7775-d09c-445a-b87c-59792a2412ed","resolution":{"observed_at":"2026-08-04T01:16:11.264145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09648","last_updated":"2025-03-12T08:42:05Z","snapshot_observed_at":"2026-07-06T20:51:32.396503Z","submitted_at":"2025-03-12T08:42:05Z","title":"A Survey on Trustworthy LLM Agents: Threats and Countermeasures","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09648","snapshot_observed_at":"2026-08-04T01:16:11.444009Z","title":"A survey on trustworthy llm agents: Threats and countermeasures,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.444009Z"},"links":{"cited_paper":"/paper/2503.09648","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:5b454b267e151125fa5bbdad1cf37299a9bcae3539fd16b4bf517a4e890958b6","observation_id":"ed4c2d9f-cf68-4431-816e-f8271dc0c47a","resolution":{"observed_at":"2026-08-04T01:16:11.444009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:11.540024Z","title":"Masterkey: Automated jailbreaking of large language model chatbots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.540024Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:0502e3b8725218a9c26c08f15d320d7fb6134281f731738752d885a078338e08","observation_id":"b701a1c7-75e3-470a-8697-8a2126d352c8","resolution":{"observed_at":"2026-08-04T01:16:11.540024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:11.664743Z","title":"Jailbreakzoo: Survey, landscapes, and horizons in jailbreaking large lan- guage and vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.664743Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:1a34ede6bfb9b7a5e2e9a7db3f6dd8579ac5da081e0c52b352982e3997f20ebe","observation_id":"9043d682-2db1-45fc-bc51-2d569acad0a4","resolution":{"observed_at":"2026-08-04T01:16:11.664743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:11.766046Z","title":"Gpt- 4 is too smart to be safe: Stealthy chat with llms via cipher,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.766046Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:16b917d3acd9b5401ce16eeeaa3313a39f8f91c2432e241d74ef5f9dc98d6979","observation_id":"1292fb00-17c5-4c13-b6d4-8fd53a9db6bc","resolution":{"observed_at":"2026-08-04T01:16:11.766046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13860","last_updated":"2024-03-10T13:58:08Z","snapshot_observed_at":"2026-07-06T15:31:18.144952Z","submitted_at":"2023-05-23T09:33:38Z","title":"Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13860","snapshot_observed_at":"2026-08-04T01:16:11.894746Z","title":"Jailbreaking chatgpt via prompt engineering: An empirical study,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:11.894746Z"},"links":{"cited_paper":"/paper/2305.13860","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:3c49921b80c85db8e6481d4a444c947a2ad62d3e7e52572a965af03ac84eb35f","observation_id":"e08f1a45-122a-409c-b3b1-99c7d60ad914","resolution":{"observed_at":"2026-08-04T01:16:11.894746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15645","last_updated":"2024-11-03T12:22:30Z","snapshot_observed_at":"2026-07-06T19:36:49.949466Z","submitted_at":"2024-10-21T05:11:19Z","title":"Boosting Jailbreak Transferability for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15645","snapshot_observed_at":"2026-08-04T01:16:12.004751Z","title":"Boosting jailbreak transferability for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.004751Z"},"links":{"cited_paper":"/paper/2410.15645","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:0fb1f41e1ea5f0f1ccf7a8a44083e44fe59cd47d6e4e02d8cf919a63f1145955","observation_id":"43d83782-7851-4cf1-97a9-6032f993231a","resolution":{"observed_at":"2026-08-04T01:16:12.004751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-04T01:16:12.144831Z","title":"Jailbreaking black box large language models in twenty queries,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.144831Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:34ba003671bf708d7f70acc7d96ea9ecf42e645c1346a91b88852ff9b567a882","observation_id":"be428ec5-f14b-4543-a2cc-a2b6aab04e02","resolution":{"observed_at":"2026-08-04T01:16:12.144831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03191","last_updated":"2024-11-28T13:43:50Z","snapshot_observed_at":"2026-08-04T19:12:56.970085Z","submitted_at":"2023-11-06T15:29:30Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03191","snapshot_observed_at":"2026-08-04T01:16:12.245800Z","title":"Deepinception: Hypnotize large language model to be jailbreaker,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.245800Z"},"links":{"cited_paper":"/paper/2311.03191","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:fb47cbfe288b5023edba843cab8843a0f02ae30d07948392ddf4269fa981510d","observation_id":"9481f41b-60c7-4599-9b37-10358127434f","resolution":{"observed_at":"2026-08-04T01:16:12.245800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10619","last_updated":"2025-05-28T09:31:33Z","snapshot_observed_at":"2026-08-02T12:09:36.861596Z","submitted_at":"2025-03-13T17:57:32Z","title":"Tempest: Autonomous Multi-Turn Jailbreaking of Large Language Models with Tree Search","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10619","snapshot_observed_at":"2026-08-04T01:16:12.344757Z","title":"Siege: Autonomous multi-turn jailbreaking of large language models with tree search,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.344757Z"},"links":{"cited_paper":"/paper/2503.10619","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:34c40e14f282bf8d2e8381b43d606c2d0b9548215f9887c7ff8e548ec7a89cec","observation_id":"bec4a2cb-5209-4cbe-9ebe-e9c849fb47d7","resolution":{"observed_at":"2026-08-04T01:16:12.344757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16459","last_updated":"2024-06-06T19:21:44Z","snapshot_observed_at":"2026-07-06T17:35:23.161066Z","submitted_at":"2024-02-26T10:03:33Z","title":"Defending LLMs against Jailbreaking Attacks via Backtranslation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16459","snapshot_observed_at":"2026-08-04T01:16:12.515641Z","title":"Defending llms against jail- breaking attacks via backtranslation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.515641Z"},"links":{"cited_paper":"/paper/2402.16459","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:4bc948d03b61a33d6b5bc77d15b8e352cde35290b112dc47edb4ef70a29ef481","observation_id":"5b40f7fa-4ed7-4e8a-ad95-f43854b50ad1","resolution":{"observed_at":"2026-08-04T01:16:12.515641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:12.672284Z","title":"Jailbroken: How does llm safety training fail?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.672284Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:02bedb341dd2c9949761968e459c62c6a79bbffe02bae4bb51b2fc7f8603fba3","observation_id":"d520fa31-9bdf-4ace-9186-f1ddc6454d72","resolution":{"observed_at":"2026-08-04T01:16:12.672284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09662","last_updated":"2023-08-30T10:21:00Z","snapshot_observed_at":"2026-08-06T17:01:00.147032Z","submitted_at":"2023-08-18T16:27:04Z","title":"Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09662","snapshot_observed_at":"2026-08-04T01:16:12.719886Z","title":"Red-teaming large language mod- els using chain of utterances for safety-alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.719886Z"},"links":{"cited_paper":"/paper/2308.09662","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:4b5e6750c23e022ccf0bc45427ffb81128f2f922a7acbff6c22b378bebff8208","observation_id":"5aa005cc-1aac-45f5-b27f-407bd964ef24","resolution":{"observed_at":"2026-08-04T01:16:12.719886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:12.788834Z","title":"Attack prompt generation for red teaming and defending large language mod- els,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.788834Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:283d44e5554b13c0f2d42c7fdcf00f320c4637b7539c99fdf3803d2b0c41d6c5","observation_id":"7a38e1ad-70e8-40d5-be3d-d16c2fb0d05d","resolution":{"observed_at":"2026-08-04T01:16:12.788834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02855","last_updated":"2025-05-20T05:38:08Z","snapshot_observed_at":"2026-07-06T18:40:44.305259Z","submitted_at":"2024-07-03T07:14:05Z","title":"From Theft to Bomb-Making: The Ripple Effect of Unlearning in Defending Against Jailbreak Attacks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02855","snapshot_observed_at":"2026-08-04T01:16:12.873272Z","title":"Safe unlearning: A surprisingly effective and generalizable solution to defend against jailbreak attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.873272Z"},"links":{"cited_paper":"/paper/2407.02855","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:490cfa8b3f14c7e0f2cf68895d3371de804f0cb60a1111c67f26b9f9b3086944","observation_id":"48601139-73e1-473a-ad66-da94405e14d2","resolution":{"observed_at":"2026-08-04T01:16:12.873272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-04T01:16:12.949365Z","title":"Baseline defenses for adversarial attacks against aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:12.949365Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:977e6332fd6e16898008e7279caff64b8e3bdbc8503ac349696b1631bcb552f6","observation_id":"fc595a05-2b83-4101-a1c1-46c4445fa5de","resolution":{"observed_at":"2026-08-04T01:16:12.949365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02705","last_updated":"2025-02-04T19:47:09Z","snapshot_observed_at":"2026-07-06T16:15:00.517258Z","submitted_at":"2023-09-06T04:37:20Z","title":"Certifying LLM Safety against Adversarial Prompting","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02705","snapshot_observed_at":"2026-08-04T01:16:13.014747Z","title":"Certifying llm safety against adversarial prompting,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.014747Z"},"links":{"cited_paper":"/paper/2309.02705","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:3664a1df82ba3344d42fd1542c9a391f49076f61ec5bc5ac16fd91843570fe27","observation_id":"771bd9f5-e888-44a8-a10d-77ae5df37a46","resolution":{"observed_at":"2026-08-04T01:16:13.014747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-04T01:16:13.134915Z","title":"Smoothllm: Defending large language models against jailbreaking attacks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.134915Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:51bd46cc66442cbe77ee82f9729a32662be933f2fa2d42f358b6b8cafdd1ded5","observation_id":"81cb2df2-f37f-457d-a8d0-16e043624665","resolution":{"observed_at":"2026-08-04T01:16:13.134915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14348","last_updated":"2024-06-12T00:27:06Z","snapshot_observed_at":"2026-07-06T16:23:26.584450Z","submitted_at":"2023-09-18T02:07:22Z","title":"Defending Against Alignment-Breaking Attacks via Robustly Aligned LLM","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14348","snapshot_observed_at":"2026-08-04T01:16:13.252157Z","title":"Defending against alignment-breaking attacks via robustly aligned llm,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.252157Z"},"links":{"cited_paper":"/paper/2309.14348","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:411d263343e049862934ef07f1a04375246d9f4dad929a4a763353e27c477e9c","observation_id":"ba8886ca-b654-4e61-8022-fc96553d7efc","resolution":{"observed_at":"2026-08-04T01:16:13.252157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:13.364750Z","title":"Defending chatgpt against jailbreak attack via self-reminders,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.364750Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:0e0467b76eeadf32d2b036f7150e5852258b3f488d6f2de80e68dbf3b8750802","observation_id":"9744ff32-f663-4470-a466-7f4a778c6c67","resolution":{"observed_at":"2026-08-04T01:16:13.364750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:13.535734Z","title":"Steering dialogue dynamics for robustness against multi-turn jailbreaking attacks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.535734Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:8133f8df144babccebfa39bc302fead2a0cba023c348be76b8819c1c849bae94","observation_id":"b0ef8a60-ca68-4930-a283-77ed33a62d93","resolution":{"observed_at":"2026-08-04T01:16:13.535734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:13.651328Z","title":"X-boundary: Establishing exact safety boundary to shield llms from multi-turn jailbreaks without compromising usability,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.651328Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:7066d8ee8f1b855e8feae0c34174d5ef7c8daa65bc0c581c117bcc2c4f45044d","observation_id":"9921ae4a-ca99-4243-9263-0365000a2123","resolution":{"observed_at":"2026-08-04T01:16:13.651328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17458","last_updated":"2025-06-07T08:11:07Z","snapshot_observed_at":"2026-07-06T19:22:27.646571Z","submitted_at":"2024-09-26T01:24:17Z","title":"RED QUEEN: Safeguarding Large Language Models against Concealed Multi-Turn Jailbreaking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17458","snapshot_observed_at":"2026-08-04T01:16:13.794829Z","title":"Red queen: Safeguarding large language models against concealed multi-turn jailbreaking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.794829Z"},"links":{"cited_paper":"/paper/2409.17458","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:d756c16d2df44e47bc74b2511188f212fbde578870b948af774ea4a2330a17d2","observation_id":"b15ac3db-aece-42e1-aa4a-759eb576099d","resolution":{"observed_at":"2026-08-04T01:16:13.794829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:13.872894Z","title":"Generative agents: Interactive simulacra of human behavior,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.872894Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:b51913196968288cca995219229838bb279e3c72088224274076744de7917bcb","observation_id":"1e43c751-4a75-44ae-8c4a-12950bd73985","resolution":{"observed_at":"2026-08-04T01:16:13.872894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16960","last_updated":"2023-10-28T09:02:39Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T14:17:36Z","title":"Training Socially Aligned Language Models on Simulated Social Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16960","snapshot_observed_at":"2026-08-04T01:16:13.946073Z","title":"Training socially aligned language models in simulated human society,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:13.946073Z"},"links":{"cited_paper":"/paper/2305.16960","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:abd0565f310fbfbc419ae69b204d03b6355849a565a3440435d1c0e8b48325e5","observation_id":"6bb1203a-fa28-45f2-88ae-bd7312b242a7","resolution":{"observed_at":"2026-08-04T01:16:13.946073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:14.022585Z","title":"Camel: Communicative agents for","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.022585Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:db5eb0dcceb9eb4303d25cc9923c50cb30a1b14cd487ee59fa6beca37ef8d5dd","observation_id":"ac613f5c-476e-4f49-936a-dd1cf9cfb4f0","resolution":{"observed_at":"2026-08-04T01:16:14.022585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-07-31T19:03:03.494918Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-04T01:16:14.080163Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversation framework,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.080163Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:711dc15fbaee952092d1a31465bf599494d16144b09e3c798c0d9711fba429c5","observation_id":"8a872541-14d7-4d58-8867-cd96d55ade56","resolution":{"observed_at":"2026-08-04T01:16:14.080163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:14.172690Z","title":"Metagpt: Meta programming for a multi-agent collaborative framework,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.172690Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:376e38349a4479d0c2b3f5b6d76c2065879dd2717281992b92147dd0db74ecad","observation_id":"d3c7f28f-25fa-4bd5-9330-81387c2e42df","resolution":{"observed_at":"2026-08-04T01:16:14.172690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07924","last_updated":"2024-06-05T13:23:49Z","snapshot_observed_at":"2026-07-06T15:54:28.831510Z","submitted_at":"2023-07-16T02:11:34Z","title":"ChatDev: Communicative Agents for Software Development","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07924","snapshot_observed_at":"2026-08-04T01:16:14.275406Z","title":"Communicative agents for software development,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.275406Z"},"links":{"cited_paper":"/paper/2307.07924","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:33494e0b187a826a76b337df8dd53b17ac095a42832b703cc0bfe72bd508a1b7","observation_id":"66ee22d6-3d85-4913-9552-7bfac0e5507c","resolution":{"observed_at":"2026-08-04T01:16:14.275406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14325","last_updated":"2023-05-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:55:11Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14325","snapshot_observed_at":"2026-08-04T01:16:14.424749Z","title":"Improving factuality and reasoning in language models through multiagent debate,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.424749Z"},"links":{"cited_paper":"/paper/2305.14325","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:fa63e38e74ffbb10cfec91ea3135713626432ac7fd40f2ae46fe644739e1b4ec","observation_id":"8892c0c9-d9e9-4521-b8d7-f7b5f9749de4","resolution":{"observed_at":"2026-08-04T01:16:14.424749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19118","last_updated":"2024-10-09T02:41:21Z","snapshot_observed_at":"2026-08-01T16:20:31.337598Z","submitted_at":"2023-05-30T15:25:45Z","title":"Encouraging Divergent Thinking in Large Language Models through Multi-Agent Debate","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19118","snapshot_observed_at":"2026-08-04T01:16:14.553943Z","title":"Encouraging divergent thinking in large language models through multi-agent debate,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.553943Z"},"links":{"cited_paper":"/paper/2305.19118","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:133cfc41ee09297b52bd0c7e48e588b0a70ee87a8cdd32b678b37ef3439b0471","observation_id":"c713df20-a4d7-48cd-9945-5ffdffa5331d","resolution":{"observed_at":"2026-08-04T01:16:14.553943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:14.624835Z","title":"Defending large language models against jailbreaking attacks through goal priori- tization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.624835Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:c5d7dbfc177d143deea1e3405d12c9a3178874bc7fcdc5ab8fcd44068ff74f02","observation_id":"ccbcfc1e-1960-4ffa-af48-ee77962be44e","resolution":{"observed_at":"2026-08-04T01:16:14.624835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:14.814826Z","title":"Robust prompt optimization for defend- ing language models against jailbreaking attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.814826Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:b90da4c6acf951cfc7354a88677c4b43c83474d9e39190a6b4fcf1fdbadbee8e","observation_id":"3de10f62-1386-4ca4-9a38-e8c914f54690","resolution":{"observed_at":"2026-08-04T01:16:14.814826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12707","last_updated":"2025-06-15T03:39:13Z","snapshot_observed_at":"2026-08-07T00:41:26.894085Z","submitted_at":"2025-06-15T03:39:13Z","title":"SecurityLingua: Efficient Defense of LLM Jailbreak Attacks via Security-Aware Prompt Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12707","snapshot_observed_at":"2026-08-04T01:16:14.920942Z","title":"Securitylin- gua: Efficient defense of llm jailbreak attacks via security-aware prompt compression,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:14.920942Z"},"links":{"cited_paper":"/paper/2506.12707","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:a678919ec9b4f7f692f1b2c49a2d1fafe6c430aee470e60a76d2f8c2aa83aa80","observation_id":"e49c6208-7c87-4509-8609-7c19ad7b1c60","resolution":{"observed_at":"2026-08-04T01:16:14.920942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:15.024609Z","title":"Fine-tuning aligned language models compromises safety, even when users do not intend to!","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:15.024609Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:b9854298a38cf0b9c2acdf6bf402d094d64062b98082c38ff83390b4d63a5dba","observation_id":"ad2bd6db-372d-4528-bcb9-99a440857d4b","resolution":{"observed_at":"2026-08-04T01:16:15.024609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:15.148273Z","title":"Jailbreaking black box large language models in twenty queries,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:15.148273Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:74e36050c29f393f31a685f90d956fd032ad858b3bcdfbd977e7467f957b3120","observation_id":"cfe5471f-fd88-46ed-a81b-d8486bf54dc1","resolution":{"observed_at":"2026-08-04T01:16:15.148273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:15.272601Z","title":"M2s: Multi-turn to single-turn jailbreak in red teaming for llms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:15.272601Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:eb8a4b205f1e794c535c7c3e7ed7f2e8c76e13c50cb52668ccb9d9a3476ac570","observation_id":"d2829aa8-a185-4f8d-bd83-8e7ce496b17e","resolution":{"observed_at":"2026-08-04T01:16:15.272601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14762","last_updated":"2024-11-05T16:40:21Z","snapshot_observed_at":"2026-07-06T17:34:07.737296Z","submitted_at":"2024-02-22T18:21:59Z","title":"MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14762","snapshot_observed_at":"2026-08-04T01:16:15.396819Z","title":"Mt-bench-101: A fine-grained benchmark for evaluating large language models in multi-turn dialogues,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:15.396819Z"},"links":{"cited_paper":"/paper/2402.14762","citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:704d4bd28c43e9e32e48513330a7cb933ee602ff3ef9d391f548df9e93316d87","observation_id":"0a22fc85-a5fe-456f-b43a-4d89dc2add11","resolution":{"observed_at":"2026-08-04T01:16:15.396819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:16:15.489997Z","title":"Cosafe: Evaluating large language model safety in multi-turn dialogue coreference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-04T01:16:15.489997Z"},"links":{"citing_paper":"/paper/2608.00134"},"observation_digest":"sha256:eb5ec3ddfc60926a5eadf333f7d4472b04b8c022e48de8249a2ce380fb817ff3","observation_id":"1702fe08-30d1-48ab-94b9-b7ac696391da","resolution":{"observed_at":"2026-08-04T01:16:15.489997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.00134","last_updated":"2026-07-31T14:04:49Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-07T04:03:39.503904Z","submitted_at":"2026-07-31T14:04:49Z","title":"Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Turn Attacks"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":66,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2608.00134."}