{"as_of":"2026-08-08T04:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d0638c76bab72a06529b942e5ba08c5c2dec1d65028d4e41b805ee0c5df23d7e","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:48:19.918679Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T09:21:57.373862Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T04:16:34.678418Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"cited_work":{"arxiv_id":"2505.17598","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17598","snapshot_observed_at":"2026-07-02T04:16:34.678418Z","title":"One model transfer to all: On robust jailbreak prompts generation against llms","venue":null,"work_id":"d5c100c7-b473-45c7-8d1f-37da1d1ba596","year":2025},"citing_paper":{"arxiv_id":"2604.10326","last_updated":"2026-04-11T19:19:05Z","snapshot_observed_at":"2026-07-06T22:59:01.129724Z","submitted_at":"2026-04-11T19:19:05Z","title":"Jailbreaking the Matrix: Nullspace Steering for Controlled Model Subversion","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-10T15:19:46.920899Z"},"links":{"cited_paper":"/paper/2505.17598","citing_paper":"/paper/2604.10326"},"observation_digest":"sha256:c7919820fdd4b6a0dea683a95274c0a0f17bfd475420a92452e1a96b442924e4","observation_id":"46d50d66-226e-4c0b-8b8c-1180341e32c7","resolution":{"observed_at":"2026-05-11T10:46:04.279470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"cited_work":{"arxiv_id":"2505.17598","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17598","snapshot_observed_at":"2026-07-02T04:16:34.678418Z","title":"One model transfer to all: On robust jailbreak prompts generation against llms","venue":null,"work_id":"d5c100c7-b473-45c7-8d1f-37da1d1ba596","year":2025},"citing_paper":{"arxiv_id":"2606.03647","last_updated":"2026-06-02T13:39:15Z","snapshot_observed_at":"2026-07-06T23:43:50.943530Z","submitted_at":"2026-06-02T13:39:15Z","title":"Black-box, Adaptive, Efficient, Transferable, Harmful, Applicable... Attacks Are All You Need to Break LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T09:21:57.373862Z"},"links":{"cited_paper":"/paper/2505.17598","citing_paper":"/paper/2606.03647"},"observation_digest":"sha256:f1e1300c6260cf69a8fd9623d9a077520ff43e52fe70af7822e62de81f61a870","observation_id":"aa48eac5-0c31-4905-8582-1f303c47d7bb","resolution":{"observed_at":"2026-07-02T04:16:34.680474Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17598/citation-record","integrity":"/paper/2505.17598/integrity","json":"/paper/2505.17598/citation-record.json","paper":"/paper/2505.17598"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:15.617814Z","title":"The claude 3 model family: Opus, sonnet, haiku, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:15.617814Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:a08fc5607a469414224e2609ac7ed91a91d54f2630da8e38942040bcfd7a0fc2","observation_id":"9be110d1-22af-492c-9931-f8253c1d3990","resolution":{"observed_at":"2026-08-07T14:48:15.617814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:22.717241Z","title":"Safety-tuned LL a MA s: Lessons from improving the safety of large language models that follow instructions","venue":null,"work_id":"3bfc68c2-9037-4cf8-b2c6-0394016126d1","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:15.699936Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:71ef53e15b03a5740cf3c33bba1432a9892405c10b7ad9a99dba857b90e0ef8d","observation_id":"e1a85fe0-6a60-411b-86a9-285e8ad8e8df","resolution":{"observed_at":"2026-08-07T14:48:22.788715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:15.759195Z","title":"Are aligned neural networks adversarially aligned? Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:15.759195Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:f527ef063726bce7f16c1c29e9aad593699a1874913f5ab15903ef739e97b992","observation_id":"f15deae1-c7e5-4e8b-abe8-1c4010af6d98","resolution":{"observed_at":"2026-08-07T14:48:15.759195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T14:48:15.829373Z","title":"Jailbreaking black box large language models in twenty queries","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:15.829373Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:77632a504b56b984a8f71d7fbe1e1de6895924f92792dafaf9f9b1598f8bbdb2","observation_id":"e91f13cf-5392-4bdb-b221-f3273a0e1237","resolution":{"observed_at":"2026-08-07T14:48:15.829373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-02T14:59:12.115203Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-07T14:48:15.972755Z","title":"Jailbreakbench: An open robustness benchmark for jailbreaking large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:15.972755Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:876342e8425c02c46176a9865caa93b2ab897c350c005f266ca83d04c4ace19a","observation_id":"5826d2a9-04e2-4dee-8cdc-cea0af0cf480","resolution":{"observed_at":"2026-08-07T14:48:15.972755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:22.556996Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90\\ See https://vicuna","venue":null,"work_id":"f6831329-a744-46a6-90b2-528bf6eca5b0","year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.019150Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:73369a2d71afacdf42bce11cc6952694aa822751869888be82b85a9c8478b88a","observation_id":"b5458565-1d25-4f62-82d3-52d3ca8d7aff","resolution":{"observed_at":"2026-08-07T14:48:22.623182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:22.446638Z","title":"Selection-inference: Exploiting large language models for interpretable logical reasoning","venue":null,"work_id":"6077100e-aec3-44de-816e-a0cb40c3d848","year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.058162Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:073f7e29a1ce74b89f7b0d479ffa8c5c36631293ad4086c7ae634316d5c07fb6","observation_id":"3f756724-bf09-463c-9e32-b9ffd3f91a58","resolution":{"observed_at":"2026-08-07T14:48:22.494668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:16.173397Z","title":"Qlora: Efficient finetuning of quantized llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.173397Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:d54661c376dadb49951da8150d59c419ddca0e58cb553e63ad7cdf7598a8ddcb","observation_id":"38d415ed-b90a-4dce-8725-81d90569c186","resolution":{"observed_at":"2026-08-07T14:48:16.173397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:22.279231Z","title":"A wolf in sheep ' s clothing: Generalized nested jailbreak prompts can fool large language models easily","venue":null,"work_id":"442b72da-39d7-413e-a50f-22b2f195b364","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.271254Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:e915acea0b3d3d281d048aac6730935794a91757ec16cf6da19081e933b79186","observation_id":"0b915e4e-f657-4a4d-a734-da761997e85e","resolution":{"observed_at":"2026-08-07T14:48:22.330055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-07T14:48:16.356727Z","title":"Baseline defenses for adversarial attacks against aligned language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.356727Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:ef93f4fff4d5f0c9d91a65b52d18ab45dc47c3711c0a9dd2347e10562847edf5","observation_id":"408ace67-dd89-4f62-ab08-1832acbcf9f0","resolution":{"observed_at":"2026-08-07T14:48:16.356727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16192","last_updated":"2024-02-28T23:11:33Z","snapshot_observed_at":"2026-07-06T17:35:14.603648Z","submitted_at":"2024-02-25T20:36:03Z","title":"Defending Large Language Models against Jailbreak Attacks via Semantic Smoothing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16192","snapshot_observed_at":"2026-08-07T14:48:16.431715Z","title":"Defending large language models against jailbreak attacks via semantic smoothing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.431715Z"},"links":{"cited_paper":"/paper/2402.16192","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:a0750ef98c3c9fa2d101710e4eb6292e97a5d659dfd1087983ccc8f410d29dec","observation_id":"cd90a318-fbaa-4d84-af95-b6006dfb8448","resolution":{"observed_at":"2026-08-07T14:48:16.431715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21018","last_updated":"2024-06-05T16:35:49Z","snapshot_observed_at":"2026-07-06T18:23:23.565502Z","submitted_at":"2024-05-31T17:07:15Z","title":"Improved Techniques for Optimization-Based Jailbreaking on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21018","snapshot_observed_at":"2026-08-07T14:48:16.511497Z","title":"Improved techniques for optimization-based jailbreaking on large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.511497Z"},"links":{"cited_paper":"/paper/2405.21018","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:fe7e2993fbbae0b90a264f0c7490342aa93fc940797f5e306b45a124753216fc","observation_id":"918cc513-33f3-4b45-aa54-b057d3f459f3","resolution":{"observed_at":"2026-08-07T14:48:16.511497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12935","last_updated":"2025-01-07T04:42:20Z","snapshot_observed_at":"2026-07-06T18:33:15.701836Z","submitted_at":"2024-06-17T03:03:34Z","title":"ChatBug: A Common Vulnerability of Aligned LLMs Induced by Chat Templates","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12935","snapshot_observed_at":"2026-08-07T14:48:16.637249Z","title":"Chatbug: A common vulnerability of aligned llms induced by chat templates","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.637249Z"},"links":{"cited_paper":"/paper/2406.12935","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:3aa6c2160f7183859e8852aacaca2c9707da22c0c57d22570980216c6d43d24e","observation_id":"73ac51c4-1e90-43ab-99d7-f2ef63c98c63","resolution":{"observed_at":"2026-08-07T14:48:16.637249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:16.715057Z","title":"Pretraining language models with human preferences","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.715057Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:f4de2968de8ed7926713b8514c92e55be99d90a7639804c10072d806060464a1","observation_id":"5936518c-8597-4575-b8f6-130a68ae89a7","resolution":{"observed_at":"2026-08-07T14:48:16.715057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14872","last_updated":"2024-02-27T13:49:22Z","snapshot_observed_at":"2026-08-06T14:36:18.172649Z","submitted_at":"2024-02-21T15:13:50Z","title":"Semantic Mirror Jailbreak: Genetic Algorithm Based Jailbreak Prompts Against Open-source LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14872","snapshot_observed_at":"2026-08-07T14:48:16.796826Z","title":"Semantic mirror jailbreak: Genetic algorithm based jailbreak prompts against open-source llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.796826Z"},"links":{"cited_paper":"/paper/2402.14872","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:0c159163a858c33d96b7ae63fc54c44910591490e8b8fb5da700a9b0a2352391","observation_id":"e4abee56-3d46-4a49-9a63-5ced7a6e294e","resolution":{"observed_at":"2026-08-07T14:48:16.796826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16914","last_updated":"2024-11-11T23:08:20Z","snapshot_observed_at":"2026-07-06T17:35:45.288097Z","submitted_at":"2024-02-25T17:43:29Z","title":"DrAttack: Prompt Decomposition and Reconstruction Makes Powerful LLM Jailbreakers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16914","snapshot_observed_at":"2026-08-07T14:48:16.908261Z","title":"Drattack: Prompt decomposition and reconstruction makes powerful llm jailbreakers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:16.908261Z"},"links":{"cited_paper":"/paper/2402.16914","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:6126e58b6365a2f2dd387888d0b17ad1f1c0454cf8bdddeba454daacc926a2cf","observation_id":"9ed957d2-2887-409b-bdcb-8842dc65627e","resolution":{"observed_at":"2026-08-07T14:48:16.908261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03191","last_updated":"2024-11-28T13:43:50Z","snapshot_observed_at":"2026-08-04T19:12:56.970085Z","submitted_at":"2023-11-06T15:29:30Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03191","snapshot_observed_at":"2026-08-07T14:48:17.045904Z","title":"Deepinception: Hypnotize large language model to be jailbreaker","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.045904Z"},"links":{"cited_paper":"/paper/2311.03191","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:c96f01b2284c0b5e882069dfd248835e07f5247a0367e0c4c690f2f4c8baf9b0","observation_id":"ddd664fb-f6f8-4189-b45d-15adea217f73","resolution":{"observed_at":"2026-08-07T14:48:17.045904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07921","last_updated":"2024-11-24T18:03:43Z","snapshot_observed_at":"2026-08-08T01:20:41.374144Z","submitted_at":"2024-04-11T17:05:50Z","title":"AmpleGCG: Learning a Universal and Transferable Generative Model of Adversarial Suffixes for Jailbreaking Both Open and Closed LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07921","snapshot_observed_at":"2026-08-07T14:48:17.137451Z","title":"Amplegcg: Learning a universal and transferable generative model of adversarial suffixes for jailbreaking both open and closed llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.137451Z"},"links":{"cited_paper":"/paper/2404.07921","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:02adbcb736274c5cd2080dd3a247c315d3f2647071f41efc9ed4c9f54ce3bd4a","observation_id":"aeaa5a8a-e36d-4082-b248-a403c076f259","resolution":{"observed_at":"2026-08-07T14:48:17.137451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:22.150637Z","title":"Auto DAN : Generating stealthy jailbreak prompts on aligned large language models","venue":null,"work_id":"d5dca74f-2306-4af7-abb4-4413c7222af5","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.268725Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:a465dc14f1995b1348b8e6063b0d0bcdd59388e656f5e07d1f96e587fdef4a8d","observation_id":"b8cc7319-4458-4b15-b79e-2996f06399bd","resolution":{"observed_at":"2026-08-07T14:48:22.202201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16717","last_updated":"2024-02-26T16:35:59Z","snapshot_observed_at":"2026-07-06T17:35:36.900600Z","submitted_at":"2024-02-26T16:35:59Z","title":"CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16717","snapshot_observed_at":"2026-08-07T14:48:17.350033Z","title":"Codechameleon: Personalized encryption framework for jailbreaking large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.350033Z"},"links":{"cited_paper":"/paper/2402.16717","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:c969e888abc5f6c0f6f2772f715300b252bfd64e9dd55335ad9bbf7de78d1fb3","observation_id":"bf238e03-c2f9-492c-ae66-27c1804f362a","resolution":{"observed_at":"2026-08-07T14:48:17.350033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:21.956728Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal","venue":null,"work_id":"1e459bda-b03d-43a5-88b8-3feb6c60221f","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.424186Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:e85d5b43c61807a810b861580dc3f6edb0c1943d3a6f23dc07d279791e8198ab","observation_id":"2304a90e-8258-4faa-9238-a1127b9121ab","resolution":{"observed_at":"2026-08-07T14:48:22.050501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:21.824943Z","title":"Tree of attacks: Jailbreaking black-box LLM s automatically","venue":null,"work_id":"aa5d4e4e-6486-4e01-9ae1-eb5b41f3df82","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.504179Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:a0401187acea5af0c2952532edabd492256e9b484c90c41397b51ec17c555c2a","observation_id":"02d8d6aa-cf37-4c38-8d34-4e8c8197181c","resolution":{"observed_at":"2026-08-07T14:48:21.862525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:21.675822Z","title":"Fight back against jailbreaking via prompt adversarial tuning","venue":null,"work_id":"e0c81ad6-6f56-442b-952f-0252c8bd1ec5","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.583940Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:c5c03fca7d9dcf4260f365d700116cd3b1a39e040b2a9feeff14f081161e121e","observation_id":"17228427-d4b0-4f0b-8a23-f9a79b307f2e","resolution":{"observed_at":"2026-08-07T14:48:21.765165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:21.529361Z","title":"Snapshot of gpt-3.5-turbo from march 1st 2023","venue":null,"work_id":"9d1338ed-1220-4c97-840f-1f2e7d9f2887","year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.650839Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:7c93ac4608f66cd052b8eaa1de5d04a794016b25373609e54d72fe7a9195e6f4","observation_id":"2e4ed94e-d0a7-412e-9bbc-189c10aee2c6","resolution":{"observed_at":"2026-08-07T14:48:21.612033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:21.386546Z","title":"Gpt-4 technical report, 2023 b","venue":null,"work_id":"04707c14-0f27-4cca-bc46-0b2de7cdb662","year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.757745Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:0a90eae44e45923cc496dc6ba4bdb6d72c0f6f897cc7374a18c299932807576d","observation_id":"acabc645-673f-4d89-9202-2fdc53bb488c","resolution":{"observed_at":"2026-08-07T14:48:21.479567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:17.865297Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.865297Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:36ee160edf0413eb428e58e134ce9cf2dac4a55383e5131dbcd29c669bf06a2a","observation_id":"68efa101-8578-4541-ac48-7954ff509fd3","resolution":{"observed_at":"2026-08-07T14:48:17.865297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:21.194747Z","title":"Red teaming language models with language models","venue":null,"work_id":"122e39e1-4479-4566-a23b-3b79e69c7620","year":2022},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:17.958546Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:42e8a815a0558734b3f2d6859f48a00d7f8655add92995ebd01407c6ff0c03b6","observation_id":"a1b439b1-373a-4894-9d43-570f3fc5a749","resolution":{"observed_at":"2026-08-07T14:48:21.255103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:18.023530Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.023530Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:b190909d96bce3ca057383d4d1160106009cce5bb09ad756bbaaa717bfdea183","observation_id":"d23f52bd-4ca5-436e-8c3e-fdb6e77fd748","resolution":{"observed_at":"2026-08-07T14:48:18.023530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-07T14:48:18.126499Z","title":"Smoothllm: Defending large language models against jailbreaking attacks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.126499Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:5908b5feee9b2a4ba1df6371a30096c65de3634da03b8b9c6d9c67cf299ea74f","observation_id":"7e846e3d-3986-4b22-8b9d-2d3536159e8e","resolution":{"observed_at":"2026-08-07T14:48:18.126499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:18.206720Z","title":"All in how you ask for it: Simple black-box method for jailbreak attacks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.206720Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:3b0eb10fa20484b073e59e80d0d5eeff227b1d1fa4ca304c5b174d715c16138b","observation_id":"528b4f7c-efa5-4ffe-8670-963e8e0dc931","resolution":{"observed_at":"2026-08-07T14:48:18.206720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T14:48:18.262919Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.262919Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:162f61e563809dcb4eebfad31cb06df8ec81ca4ac1f486a7b8982a457a219e6f","observation_id":"c4d9d5f7-4adc-4145-b18d-77eaef25c03c","resolution":{"observed_at":"2026-08-07T14:48:18.262919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12966","last_updated":"2023-07-24T17:44:58Z","snapshot_observed_at":"2026-07-06T15:57:57.167169Z","submitted_at":"2023-07-24T17:44:58Z","title":"Aligning Large Language Models with Human: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12966","snapshot_observed_at":"2026-08-07T14:48:18.341107Z","title":"Aligning large language models with human: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.341107Z"},"links":{"cited_paper":"/paper/2307.12966","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:03ce3fadf354ff41ccb04c7f08dbf19ee0e428b7d73cebd098d8a35ade49a2da","observation_id":"609374de-bfb4-44d8-8669-6b56623f2efb","resolution":{"observed_at":"2026-08-07T14:48:18.341107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:18.427408Z","title":"Jailbroken: How does llm safety training fail? Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.427408Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:e28014f9b4688d2e6584d8c74ce5b072eb2b2d201686de84926a897cf646c4ab","observation_id":"c36690dc-aa9e-4741-acf3-4065a55dbbf1","resolution":{"observed_at":"2026-08-07T14:48:18.427408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09127","last_updated":"2024-01-20T18:55:51Z","snapshot_observed_at":"2026-08-06T11:22:22.190789Z","submitted_at":"2023-11-15T17:17:39Z","title":"Jailbreaking GPT-4V via Self-Adversarial Attacks with System Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09127","snapshot_observed_at":"2026-08-07T14:48:18.483319Z","title":"Jailbreaking gpt-4v via self-adversarial attacks with system prompts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.483319Z"},"links":{"cited_paper":"/paper/2311.09127","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:c94e3192aed3001fd3aad0eae522ffa26c9d85839a6331b8388bbde58c01adcc","observation_id":"77d3c26e-d3d3-4b02-ba96-47104965f923","resolution":{"observed_at":"2026-08-07T14:48:18.483319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20099","last_updated":"2025-06-04T02:59:37Z","snapshot_observed_at":"2026-07-06T18:22:44.129954Z","submitted_at":"2024-05-30T14:40:35Z","title":"Defensive Prompt Patch: A Robust and Interpretable Defense of LLMs against Jailbreak Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20099","snapshot_observed_at":"2026-08-07T14:48:18.627766Z","title":"Defensive prompt patch: A robust and interpretable defense of llms against jailbreak attacks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.627766Z"},"links":{"cited_paper":"/paper/2405.20099","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:d1647ea4bf36b4a7c8c0c683ddfe6d4e958f741375402df41ff47f80eea291d6","observation_id":"a5dde6f0-a376-49b4-8038-159cbddccc4f","resolution":{"observed_at":"2026-08-07T14:48:18.627766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:20.997636Z","title":"Safedecoding: Defending against jailbreak attacks via safety-aware decoding","venue":null,"work_id":"e91a6953-9edc-4764-a4a0-5b223be6687e","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.710971Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:7c31cbd55549c6f1079134f9d52eb10512f2be01ee68c2a6e69f0f320446fb28","observation_id":"04a3ae29-f7e2-4cdd-95a4-35d10a75d655","resolution":{"observed_at":"2026-08-07T14:48:21.088976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09324","last_updated":"2024-11-06T04:43:57Z","snapshot_observed_at":"2026-07-06T18:30:28.421247Z","submitted_at":"2024-06-13T17:01:40Z","title":"Bag of Tricks: Benchmarking of Jailbreak Attacks on LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09324","snapshot_observed_at":"2026-08-07T14:48:18.758264Z","title":"Bag of tricks: Benchmarking of jailbreak attacks on llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.758264Z"},"links":{"cited_paper":"/paper/2406.09324","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:e094fedc600cf78205d3548eab398919be8ea410b318476edeb58988cdfc768f","observation_id":"17efba1d-e493-4593-9413-d13bedbf7dbd","resolution":{"observed_at":"2026-08-07T14:48:18.758264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-07T14:48:18.798279Z","title":"Gptfuzzer: Red teaming large language models with auto-generated jailbreak prompts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.798279Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:cff7d850fcfd270bd411595921d6896e0843bd9cd5185d431757a345b528cd7f","observation_id":"22469730-0548-4f43-9834-ff7767665d82","resolution":{"observed_at":"2026-08-07T14:48:18.798279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00286","last_updated":"2023-12-10T13:58:24Z","snapshot_observed_at":"2026-07-30T17:50:50.928725Z","submitted_at":"2023-11-01T04:36:45Z","title":"JADE: A Linguistics-based Safety Evaluation Platform for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00286","snapshot_observed_at":"2026-08-07T14:48:18.912188Z","title":"Jade: A linguistics-based safety evaluation platform for llm","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.912188Z"},"links":{"cited_paper":"/paper/2311.00286","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:0b56d5401cd7e530c355bc17c90e06ef1b7942cad677926684f0c88c3e76639a","observation_id":"69334d55-1a3f-464a-9983-23534f772871","resolution":{"observed_at":"2026-08-07T14:48:18.912188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:18.994663Z","title":"Instruction tuning for large language models: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:18.994663Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:da8fdf7111c28bbf751ff38f9761cf1f6490cc857ba2ec596689833e5b4bab5b","observation_id":"d81e1812-e9bd-491f-b1c1-38c5021983f9","resolution":{"observed_at":"2026-08-07T14:48:18.994663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:20.904416Z","title":"Boosting jailbreak attack with momentum","venue":null,"work_id":"7ecc7000-86ab-486e-8876-30d3e4fca700","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.065101Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:e013fbba9e73bdb8de9d164df671a55f4d81365bf717bd4b21b1ad8edd725a03","observation_id":"e12c41e2-6819-4e02-910f-74c7d0eb0f50","resolution":{"observed_at":"2026-08-07T14:48:20.944684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01251","last_updated":"2024-11-08T06:07:51Z","snapshot_observed_at":"2026-07-06T17:38:38.108579Z","submitted_at":"2024-03-02T16:23:44Z","title":"Accelerating Greedy Coordinate Gradient and General Prompt Optimization via Probe Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01251","snapshot_observed_at":"2026-08-07T14:48:19.161847Z","title":"Accelerating greedy coordinate gradient via probe sampling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.161847Z"},"links":{"cited_paper":"/paper/2403.01251","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:c5b84495026468a537ee6c9a41984127eded1317e0e4866a88833392efc0eb40","observation_id":"81ad2ebf-cefc-41f9-9e41-35f614470b81","resolution":{"observed_at":"2026-08-07T14:48:19.161847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17568","last_updated":"2024-07-10T03:52:58Z","snapshot_observed_at":"2026-07-06T15:10:12.213443Z","submitted_at":"2023-03-30T17:34:01Z","title":"CodeGeeX: A Pre-Trained Model for Code Generation with Multilingual Benchmarking on HumanEval-X","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17568","snapshot_observed_at":"2026-08-07T14:48:19.249678Z","title":"Codegeex: A pre-trained model for code generation with multilingual evaluations on humaneval-x","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.249678Z"},"links":{"cited_paper":"/paper/2303.17568","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:17d208e822ce74c62d11c96b5fd74cf009146092fa8e933a2fb4b3cfc51432b6","observation_id":"19be7a68-208f-49fa-9f69-19f6108d4d59","resolution":{"observed_at":"2026-08-07T14:48:19.249678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:20.739434Z","title":"Robust prompt optimization for defending language models against jailbreaking attacks","venue":null,"work_id":"29a02bb7-4efa-49b5-b24b-49274c93c18a","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.359882Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:0847e2cff91134ca7e9e9ae0574389cc90453f4c64212be8c58dae1cbf8a35ce","observation_id":"161fdb6c-d5b6-4790-9aa6-510d377279ce","resolution":{"observed_at":"2026-08-07T14:48:20.834533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:20.609755Z","title":"Auto DAN : Interpretable gradient-based adversarial attacks on large language models","venue":null,"work_id":"28e9dc6d-86b8-4efc-828b-4a9867aa6cbc","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.421019Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:7f8c925561b4c094bf795cd4af2c79843a40aff6a50c0ba1b029ea046f713ca4","observation_id":"6cc63926-d7fa-499c-9d4c-e5013cc51127","resolution":{"observed_at":"2026-08-07T14:48:20.651337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:20.455610Z","title":"Toolqa: A dataset for llm question answering with external tools","venue":null,"work_id":"49faf533-9b54-40a8-a911-b730977bd79a","year":2024},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.477699Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:74dd231d9a444be0c9c8ee936153fbe7f6dd9500b49e36fc20da007c5dfaae6c","observation_id":"49a229ff-004e-4c39-928d-e2216b637aff","resolution":{"observed_at":"2026-08-07T14:48:20.549914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T14:48:19.585178Z","title":"Universal and transferable adversarial attacks on aligned language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.585178Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:9c6a421b06f05ccf8d0176b4c35ca69b480557be337d2d834afe3f60d7b190da","observation_id":"333d6902-87b6-4470-85e4-59b3582d147d","resolution":{"observed_at":"2026-08-07T14:48:19.585178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:19.695447Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.695447Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:841b04a3d33d39ddb2a9a7d401cf3adc04174687110344dd7dd579a71a8cd2ed","observation_id":"38ebce12-0746-4952-998c-0d87a844b871","resolution":{"observed_at":"2026-08-07T14:48:19.695447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:19.755580Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.755580Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:bbb7d2e60d278ff2eaeee1c391b5452010ced01b4a0f12bc795f57c49912ea0c","observation_id":"1749b9e1-2346-4049-bc1c-48a9f287426b","resolution":{"observed_at":"2026-08-07T14:48:19.755580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:19.815959Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.815959Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:3da868ab611bbfbc0888abcabf42ab4892df65eed3e9526b5e4b94f10a413760","observation_id":"d21e31e3-1391-41f2-b9a5-1688a76abfea","resolution":{"observed_at":"2026-08-07T14:48:19.815959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:48:19.918679Z","title":"1zMx:sy;[c݅ EƐ uqmqpN <Q jL . yTWVU+ MϫQ= U>s:4K I )?,˖?. ٨S/M G+2 -.Zy X ʛ Cc.M @/HB 60Hqv _A ` 㵸YCZ 6pQnm 9yI","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T14:48:19.918679Z"},"links":{"citing_paper":"/paper/2505.17598"},"observation_digest":"sha256:6004d022b58a38a179c28b199db66ea405eba1c899c9cc2d306867d90ba7cd31","observation_id":"78124580-7b17-4804-a32f-f3dac5904765","resolution":{"observed_at":"2026-08-07T14:48:19.918679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17598","last_updated":"2025-05-23T08:02:38Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-08T01:21:04.072309Z","submitted_at":"2025-05-23T08:02:38Z","title":"One Model Transfer to All: On Robust Jailbreak Prompts Generation against LLMs"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 2 inbound Pith citation observations for arXiv:2505.17598."}