{"as_of":"2026-08-13T05:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2742ffc3905008364f6e8563112fcc0731516b79b63a631b4caa0ad1ebb9170c","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:56:34.469917Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.16642/citation-record","integrity":"/paper/2411.16642/integrity","json":"/paper/2411.16642/citation-record.json","paper":"/paper/2411.16642"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.12503","last_updated":"2025-06-11T23:27:36Z","snapshot_observed_at":"2026-08-13T00:50:34.748921Z","submitted_at":"2024-03-19T07:10:58Z","title":"Securing Large Language Models: Threats, Vulnerabilities and Responsible Practices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12503","snapshot_observed_at":"2026-08-12T12:56:34.290934Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.290934Z"},"links":{"cited_paper":"/paper/2403.12503","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:886437f46b0e56fde6da17db448a68adfd1fad166ec5a5c820431eb4e3f9c4ab","observation_id":"e98c5390-899e-413d-8b82-a6eaa3e64b90","resolution":{"observed_at":"2026-08-12T12:56:34.290934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T12:56:34.295258Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.295258Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:bbe0f84688b8c5f56fd1f77047e5b72f6532e7bc65e83ee3ac22f66a447ccc2c","observation_id":"d2447f0e-4212-498c-8d80-1784255e054c","resolution":{"observed_at":"2026-08-12T12:56:34.295258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02151","last_updated":"2025-04-17T18:55:45Z","snapshot_observed_at":"2026-08-13T00:39:04.444350Z","submitted_at":"2024-04-02T17:58:27Z","title":"Jailbreaking Leading Safety-Aligned LLMs with Simple Adaptive Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02151","snapshot_observed_at":"2026-08-12T12:56:34.299274Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.299274Z"},"links":{"cited_paper":"/paper/2404.02151","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:0141998d1e1710eb2740447ba738a69cc221010d802ad2a88a19db5dc7482e0c","observation_id":"49b9a9b9-f79b-4403-bc62-82afae082274","resolution":{"observed_at":"2026-08-12T12:56:34.299274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07875","last_updated":"2024-03-19T16:50:50Z","snapshot_observed_at":"2026-08-13T00:41:30.650519Z","submitted_at":"2023-09-14T17:23:37Z","title":"Safety-Tuned LLaMAs: Lessons From Improving the Safety of Large Language Models that Follow Instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07875","snapshot_observed_at":"2026-08-12T12:56:34.303034Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.303034Z"},"links":{"cited_paper":"/paper/2309.07875","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:d443b3bbbe90923cdf1f4ce82382ccf373d399f0d6d672faa2522b2ee02dd261","observation_id":"58bb5456-62ae-4b90-a6dc-de5594dec3f7","resolution":{"observed_at":"2026-08-12T12:56:34.303034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14348","last_updated":"2024-06-12T00:27:06Z","snapshot_observed_at":"2026-07-06T16:23:26.584450Z","submitted_at":"2023-09-18T02:07:22Z","title":"Defending Against Alignment-Breaking Attacks via Robustly Aligned LLM","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14348","snapshot_observed_at":"2026-08-12T12:56:34.307063Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.307063Z"},"links":{"cited_paper":"/paper/2309.14348","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:c8f70db0649d3d98853ec93947c34b0b668bdc60d32046a14fb908b971844de6","observation_id":"15a6dbab-92a4-48b2-b325-2b739640f72a","resolution":{"observed_at":"2026-08-12T12:56:34.307063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09326","last_updated":"2024-08-18T01:58:03Z","snapshot_observed_at":"2026-08-12T23:02:04.646256Z","submitted_at":"2024-08-18T01:58:03Z","title":"Characterizing and Evaluating the Reliability of LLMs against Jailbreak Attacks","version":1},"cited_work":{"arxiv_id":"2408.09326","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.09326","snapshot_observed_at":"2026-08-12T12:56:34.932874Z","title":"Characterizing and Evaluating the Reliability of LLMs against Jailbreak Attacks","venue":"cs.CL","work_id":"cccf6039-66a9-4664-8c9f-7da9c2fd385f","year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.311163Z"},"links":{"cited_paper":"/paper/2408.09326","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:b9a38696a4ecf9a4d9ef61274efd35f019591bebfedae42eb102bec8bcdff9dd","observation_id":"f65ba227-aa0f-4ca7-b1fc-56cf4f89d922","resolution":{"observed_at":"2026-08-12T12:56:34.939104Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09177","last_updated":"2024-10-02T10:43:07Z","snapshot_observed_at":"2026-08-13T04:19:07.574120Z","submitted_at":"2024-02-14T13:45:19Z","title":"Leveraging the Context through Multi-Round Interactions for Jailbreaking Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09177","snapshot_observed_at":"2026-08-12T12:56:34.315567Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.315567Z"},"links":{"cited_paper":"/paper/2402.09177","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:3bb970efc458527b934568fe2d733e5042e429882c87355a98743883490ed78d","observation_id":"d6f7d7e3-797d-42a4-a8b2-7551c2389e9c","resolution":{"observed_at":"2026-08-12T12:56:34.315567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12505","last_updated":"2023-10-19T06:15:05Z","snapshot_observed_at":"2026-08-09T11:31:22.019671Z","submitted_at":"2023-10-19T06:15:05Z","title":"Attack Prompt Generation for Red Teaming and Defending Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12505","snapshot_observed_at":"2026-08-12T12:56:34.319291Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.319291Z"},"links":{"cited_paper":"/paper/2310.12505","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:67a214d15b1678bc1c765ca96a5552ae78a7f7d2b611514bb0ac642a9613a659","observation_id":"408d72a8-6bdc-47d9-9841-c597b14ee4c4","resolution":{"observed_at":"2026-08-12T12:56:34.319291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-08-11T04:58:43.785083Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-12T12:56:34.323312Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.323312Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:558efe0c15a50e12f59bb0ef5ad73e90a923edd177de69bdeedf62783046ea9b","observation_id":"3c57c9ba-6fe9-4931-97b2-b723cad45443","resolution":{"observed_at":"2026-08-12T12:56:34.323312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08679","last_updated":"2024-06-07T00:13:08Z","snapshot_observed_at":"2026-08-13T04:19:36.304840Z","submitted_at":"2024-02-13T18:58:48Z","title":"COLD-Attack: Jailbreaking LLMs with Stealthiness and Controllability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08679","snapshot_observed_at":"2026-08-12T12:56:34.327155Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.327155Z"},"links":{"cited_paper":"/paper/2402.08679","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:4acb7fbb77782a9efdab8a011949b628f8e31182ff130476bc0627e7baa14298","observation_id":"1074104e-45eb-4143-a693-b0184be1a2a7","resolution":{"observed_at":"2026-08-12T12:56:34.327155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:56:34.331374Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.331374Z"},"links":{"citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:13235b8a48e0e86ab1782cc3acf08f1f2b3a540202569b6ec67b4f37a61a4acb","observation_id":"67d036c6-9ff6-4de9-87ee-2658e44141b5","resolution":{"observed_at":"2026-08-12T12:56:34.331374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13662","last_updated":"2025-01-27T23:35:48Z","snapshot_observed_at":"2026-08-12T23:39:05.186226Z","submitted_at":"2024-06-19T16:09:58Z","title":"Jailbreaking Large Language Models Through Alignment Vulnerabilities in Out-of-Distribution Settings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13662","snapshot_observed_at":"2026-08-12T12:56:34.335011Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.335011Z"},"links":{"cited_paper":"/paper/2406.13662","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:540dd6e940595a5ce1dfaec965b38d9a60a53c37193747f892b5978fa9ea1a34","observation_id":"3d408e4a-5971-47b1-bf66-79d9dc038cb6","resolution":{"observed_at":"2026-08-12T12:56:34.335011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-12T12:56:34.339189Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.339189Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:4c3c3ff6e1bc621b64691096dd9a1c5b56f3bc265a7a2e4f516335c9237fce0f","observation_id":"284fb806-be0c-4aa1-8601-8e65a687355b","resolution":{"observed_at":"2026-08-12T12:56:34.339189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15180","last_updated":"2024-02-27T01:39:20Z","snapshot_observed_at":"2026-08-13T04:12:18.009364Z","submitted_at":"2024-02-23T08:22:24Z","title":"Break the Breakout: Reinventing LM Defense Against Jailbreak Attacks with Self-Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15180","snapshot_observed_at":"2026-08-12T12:56:34.342791Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.342791Z"},"links":{"cited_paper":"/paper/2402.15180","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:a4f99451b782bfb3fc54a1aaf63d698249bf621c3ac2748945f3a63125594e25","observation_id":"65e55d71-05cf-49a6-8fa6-2c1566ee4a69","resolution":{"observed_at":"2026-08-12T12:56:34.342791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:56:34.346716Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.346716Z"},"links":{"citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:fa8d75baa0e2d51ccefdfa0cc7cfa9b0d36be890e1be4300194af3eca1d1da05","observation_id":"47946434-8f83-43f4-be03-9dabb35ab569","resolution":{"observed_at":"2026-08-12T12:56:34.346716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15221","last_updated":"2024-09-04T00:58:59Z","snapshot_observed_at":"2026-08-12T22:56:25.482748Z","submitted_at":"2024-08-27T17:33:30Z","title":"LLM Defenses Are Not Robust to Multi-Turn Human Jailbreaks Yet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15221","snapshot_observed_at":"2026-08-12T12:56:34.350058Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.350058Z"},"links":{"cited_paper":"/paper/2408.15221","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:6525534b28ad898d6c4f56a7ac1731d8db7a1327937b6d4680153ae9caaf8eb4","observation_id":"b18e5a34-b60d-4206-8ed2-1f425e7d0948","resolution":{"observed_at":"2026-08-12T12:56:34.350058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16914","last_updated":"2024-11-11T23:08:20Z","snapshot_observed_at":"2026-08-13T04:10:32.565258Z","submitted_at":"2024-02-25T17:43:29Z","title":"DrAttack: Prompt Decomposition and Reconstruction Makes Powerful LLM Jailbreakers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16914","snapshot_observed_at":"2026-08-12T12:56:34.353697Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.353697Z"},"links":{"cited_paper":"/paper/2402.16914","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:3aefe5af9b96e66e119062e3395ac5fb4936c0dcbe9d3f3ed2836c0087b5f334","observation_id":"3fbafe84-8082-47b3-8d47-fd9ef341edcd","resolution":{"observed_at":"2026-08-12T12:56:34.353697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13068","last_updated":"2026-04-18T08:25:50Z","snapshot_observed_at":"2026-08-04T20:18:53.393132Z","submitted_at":"2024-05-20T17:17:55Z","title":"Uncovering Logit Suppression Vulnerabilities in LLM Safety Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13068","snapshot_observed_at":"2026-08-12T12:56:34.357341Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.357341Z"},"links":{"cited_paper":"/paper/2405.13068","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:c9e30a3addc337b76a0fc0c7f727e34facf81e69c78ce774f6041ad00f6c7b9d","observation_id":"ab6b9c2f-aa1d-4363-aa7d-9d7eddbee3a9","resolution":{"observed_at":"2026-08-12T12:56:34.357341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-12T12:56:34.361287Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.361287Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:8490cfed2991289d27b2648fbbda19226d8f85ac7839cfab2c0ab4e02dd678b7","observation_id":"50432837-a136-4423-81b9-7a9054336ea2","resolution":{"observed_at":"2026-08-12T12:56:34.361287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:56:35.058471Z","title":null,"venue":null,"work_id":"0c42a00d-9da6-4ce9-ba27-e87d45065a8d","year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.364950Z"},"links":{"citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:3ef06dbbe78dee052e6a5bbb0e264d36d3dd68bf6e5a4288a40a50362ed1c987","observation_id":"f6a0c90a-cc14-4fdc-add5-7b7e623490c2","resolution":{"observed_at":"2026-08-12T12:56:35.062543Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13860","last_updated":"2024-03-10T13:58:08Z","snapshot_observed_at":"2026-07-06T15:31:18.144952Z","submitted_at":"2023-05-23T09:33:38Z","title":"Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13860","snapshot_observed_at":"2026-08-12T12:56:34.368424Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.368424Z"},"links":{"cited_paper":"/paper/2305.13860","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:1515324665b41e4d6c143847789d1ef7ee99f9fe99265248b9a993f0c7ed6ab9","observation_id":"8a879aa1-88c5-4ac7-b6e9-658548f01a5a","resolution":{"observed_at":"2026-08-12T12:56:34.368424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03805","last_updated":"2024-06-06T07:24:41Z","snapshot_observed_at":"2026-08-12T23:49:04.295519Z","submitted_at":"2024-06-06T07:24:41Z","title":"AutoJailbreak: Exploring Jailbreak Attacks and Defenses through a Dependency Lens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03805","snapshot_observed_at":"2026-08-12T12:56:34.371621Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.371621Z"},"links":{"cited_paper":"/paper/2406.03805","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:c1d4bf87516d92e06f8f778a32782f9bd83dfabace44377c8dda4bb710d0f65e","observation_id":"38714d37-1a47-4457-a083-421c074641ae","resolution":{"observed_at":"2026-08-12T12:56:34.371621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05880","last_updated":"2024-07-03T17:52:00Z","snapshot_observed_at":"2026-08-13T00:34:39.088526Z","submitted_at":"2024-04-08T21:26:22Z","title":"Eraser: Jailbreaking Defense in Large Language Models via Unlearning Harmful Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05880","snapshot_observed_at":"2026-08-12T12:56:34.375037Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.375037Z"},"links":{"cited_paper":"/paper/2404.05880","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:671e4d51ca0deeaffa74f64a2bcd4b03d60bdee795a9b538d733047b78b164c4","observation_id":"80832f94-1d39-4adf-a1bc-040ffecf9464","resolution":{"observed_at":"2026-08-12T12:56:34.375037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03027","last_updated":"2024-11-24T06:22:37Z","snapshot_observed_at":"2026-08-13T00:38:11.233371Z","submitted_at":"2024-04-03T19:23:18Z","title":"JailBreakV: A Benchmark for Assessing the Robustness of MultiModal Large Language Models against Jailbreak Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03027","snapshot_observed_at":"2026-08-12T12:56:34.378197Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.378197Z"},"links":{"cited_paper":"/paper/2404.03027","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:c37acb5c85c108fa26b27a1aefd6665cdd8f6642851563d42128dc386d49ce81","observation_id":"fbd17e9b-c4ef-44af-bbbe-84088a5a3313","resolution":{"observed_at":"2026-08-12T12:56:34.378197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02119","last_updated":"2024-10-31T15:57:42Z","snapshot_observed_at":"2026-08-13T05:10:10.124014Z","submitted_at":"2023-12-04T18:49:23Z","title":"Tree of Attacks: Jailbreaking Black-Box LLMs Automatically","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02119","snapshot_observed_at":"2026-08-12T12:56:34.381629Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.381629Z"},"links":{"cited_paper":"/paper/2312.02119","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:796443ff862fd3b869e4672875463f66c43a1b65e51ebd4a2aa9573d51b97613","observation_id":"d465cfd4-afe9-4cf4-9fc1-73caf11ab14e","resolution":{"observed_at":"2026-08-12T12:56:34.381629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:56:35.047589Z","title":null,"venue":null,"work_id":"e7a283b5-9919-490d-a6ad-6db9fc8db180","year":2023},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.385271Z"},"links":{"citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:6b5b73651e15468bc7a20eadf83fec646b2043d81a34db46dd0e8b9d9d6c58f8","observation_id":"a0cc8d3e-bde7-4868-9582-872253eb5748","resolution":{"observed_at":"2026-08-12T12:56:35.051215Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15236","last_updated":"2026-05-27T16:38:46Z","snapshot_observed_at":"2026-08-12T22:19:22.608830Z","submitted_at":"2024-10-20T00:00:56Z","title":"Jailbreaking and Mitigation of Vulnerabilities in Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15236","snapshot_observed_at":"2026-08-12T12:56:34.388685Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.388685Z"},"links":{"cited_paper":"/paper/2410.15236","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:b0fd76628dbe1124556122b1da88635463bd5212ab2d0c6cb0ddeac2d297b4e5","observation_id":"1d5fbf9b-8759-4227-b413-d46ead61fbb0","resolution":{"observed_at":"2026-08-12T12:56:34.388685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:56:35.036312Z","title":null,"venue":null,"work_id":"7eaa6940-b7b0-4a12-8362-7b91528c81c8","year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.392269Z"},"links":{"citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:b24edb68ba055c54781656b2bcc6c795cb1034766c8349621b2b80f8294d9f77","observation_id":"5b9c9257-3900-4cec-af19-fab08cb75489","resolution":{"observed_at":"2026-08-12T12:56:35.040037Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-12T12:56:34.395775Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.395775Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:1b88d0595438186225a1341347f3dc07c943dfa7fe782aef6c899af04e7bfdf4","observation_id":"06494047-73c2-4239-8cf0-5be002ca1417","resolution":{"observed_at":"2026-08-12T12:56:34.395775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11755","last_updated":"2024-02-19T00:53:48Z","snapshot_observed_at":"2026-08-13T04:15:51.692441Z","submitted_at":"2024-02-19T00:53:48Z","title":"SPML: A DSL for Defending Language Models Against Prompt Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11755","snapshot_observed_at":"2026-08-12T12:56:34.399480Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.399480Z"},"links":{"cited_paper":"/paper/2402.11755","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:e8ead5f1d8eddf8cfb61d35dd5e7fc9d1156fe12f7afa798b397b02541a7f435","observation_id":"f6a1dae7-928a-425f-90de-f8969432252a","resolution":{"observed_at":"2026-08-12T12:56:34.399480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03825","last_updated":"2024-05-15T12:06:31Z","snapshot_observed_at":"2026-07-06T16:03:34.432602Z","submitted_at":"2023-08-07T16:55:20Z","title":"\"Do Anything Now\": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03825","snapshot_observed_at":"2026-08-12T12:56:34.403118Z","title":"do anything now","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.403118Z"},"links":{"cited_paper":"/paper/2308.03825","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:1e5e25a36652869f5e69db6f8d40eb6c18779ed5cf5dd446876aee6ef6ca7411","observation_id":"e614dfc7-feb3-4d56-b2b3-1fc5bc4e1115","resolution":{"observed_at":"2026-08-12T12:56:34.403118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09040","last_updated":"2024-10-11T17:55:09Z","snapshot_observed_at":"2026-08-12T22:25:12.493243Z","submitted_at":"2024-10-11T17:55:09Z","title":"AttnGCG: Enhancing Jailbreaking Attacks on LLMs with Attention Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09040","snapshot_observed_at":"2026-08-12T12:56:34.406750Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.406750Z"},"links":{"cited_paper":"/paper/2410.09040","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:2feffd6e9af6c9a8218dcfe0614c29f6649e9d30d78f3481563e6272252b9cf2","observation_id":"d257de41-47d1-4880-8d59-30a34f52a0b9","resolution":{"observed_at":"2026-08-12T12:56:34.406750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:56:34.410450Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.410450Z"},"links":{"citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:ffe30fae0d706218010151f00e4ee9c8aac027e2eda0dfdb67f7c8ce9f77c340","observation_id":"3d7ab192-b143-4ada-9849-43c0bfd7c009","resolution":{"observed_at":"2026-08-12T12:56:34.410450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13494","last_updated":"2024-05-29T21:45:35Z","snapshot_observed_at":"2026-08-13T04:14:03.567437Z","submitted_at":"2024-02-21T03:09:21Z","title":"GradSafe: Detecting Jailbreak Prompts for LLMs via Safety-Critical Gradient Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13494","snapshot_observed_at":"2026-08-12T12:56:34.413670Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.413670Z"},"links":{"cited_paper":"/paper/2402.13494","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:845db7d2b7161cc300c9d5266447d75ed2b48e9cb6e46aa84d18bf1ff4c67cdb","observation_id":"c628ec6d-4b6e-4b2d-821f-4fe4f4b1549c","resolution":{"observed_at":"2026-08-12T12:56:34.413670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:56:34.418519Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.418519Z"},"links":{"citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:4e4da6a211d6ca79519e1627cc8a016f8e6a7db3ae2168cf4e0bacfe80b4b001","observation_id":"f25ca68d-16dc-4a65-ae2b-fc333c661d60","resolution":{"observed_at":"2026-08-12T12:56:34.418519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20099","last_updated":"2025-06-04T02:59:37Z","snapshot_observed_at":"2026-08-12T23:54:07.818641Z","submitted_at":"2024-05-30T14:40:35Z","title":"Defensive Prompt Patch: A Robust and Interpretable Defense of LLMs against Jailbreak Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20099","snapshot_observed_at":"2026-08-12T12:56:34.422868Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.422868Z"},"links":{"cited_paper":"/paper/2405.20099","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:86678d925f2f730ae09e2b9839d28122083eee1b4522f06da4249d44ac05d877","observation_id":"c075dd43-a433-4417-b3cf-4777feca7a05","resolution":{"observed_at":"2026-08-12T12:56:34.422868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01038","last_updated":"2024-03-02T00:10:45Z","snapshot_observed_at":"2026-08-13T04:05:11.219568Z","submitted_at":"2024-03-02T00:10:45Z","title":"AutoAttacker: A Large Language Model Guided System to Implement Automatic Cyber-attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01038","snapshot_observed_at":"2026-08-12T12:56:34.426125Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.426125Z"},"links":{"cited_paper":"/paper/2403.01038","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:e9fb06ebe765e1fe42370a991b3cf787ca65e32041b70f8f27842c5ebe0de22f","observation_id":"51ee9d0d-8481-459f-80b0-9f84a816c713","resolution":{"observed_at":"2026-08-12T12:56:34.426125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09324","last_updated":"2024-11-06T04:43:57Z","snapshot_observed_at":"2026-08-12T23:43:22.765242Z","submitted_at":"2024-06-13T17:01:40Z","title":"Bag of Tricks: Benchmarking of Jailbreak Attacks on LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09324","snapshot_observed_at":"2026-08-12T12:56:34.429581Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.429581Z"},"links":{"cited_paper":"/paper/2406.09324","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:65d1f9bd5dca1138fd8844dc7c440f5e2a1a8c0e2032b9b5f697905eba6551d8","observation_id":"3b0cf8ee-c4b5-4fac-a3d5-ad6b55ad6f16","resolution":{"observed_at":"2026-08-12T12:56:34.429581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:56:35.012244Z","title":null,"venue":null,"work_id":"4eaa250c-0a58-4e89-b1f7-75a581d5ad99","year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.433173Z"},"links":{"citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:c219e09bb8cd7e3657488a192979d90c2e4bdd350cdcf71c6a800ac7c133c337","observation_id":"bc31f1b7-2513-4c06-825f-385220a7b589","resolution":{"observed_at":"2026-08-12T12:56:35.015942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-08-13T04:14:06.201000Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-12T12:56:34.436610Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.436610Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:5da5c0719cbb2769dde0807ffaf079c3a05da069f8ecea2a4d81720f5187a3c6","observation_id":"3ff11792-086c-4f89-ac02-d8e4b3463c23","resolution":{"observed_at":"2026-08-12T12:56:34.436610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-12T17:45:10.384900Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04295","snapshot_observed_at":"2026-08-12T12:56:34.440390Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.440390Z"},"links":{"cited_paper":"/paper/2407.04295","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:b12b93698aaa1c101e164a7977b7c2d0d4096ad59b372a3230bf6a92c071509f","observation_id":"efcf82a0-65d8-461f-862b-631fde1ca5a2","resolution":{"observed_at":"2026-08-12T12:56:34.440390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17336","last_updated":"2024-09-30T21:25:23Z","snapshot_observed_at":"2026-08-13T00:45:06.109137Z","submitted_at":"2024-03-26T02:47:42Z","title":"Don't Listen To Me: Understanding and Exploring Jailbreak Prompts of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17336","snapshot_observed_at":"2026-08-12T12:56:34.444010Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.444010Z"},"links":{"cited_paper":"/paper/2403.17336","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:b30d3f64c46db3a161bbea9688910cbad799ec80129cd4cfdfa2e768e967820d","observation_id":"c3b568ca-b80e-445a-a1d4-714cfde7fb99","resolution":{"observed_at":"2026-08-12T12:56:34.444010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04783","last_updated":"2024-11-14T18:14:00Z","snapshot_observed_at":"2026-08-13T04:04:56.209475Z","submitted_at":"2024-03-02T16:52:22Z","title":"AutoDefense: Multi-Agent LLM Defense against Jailbreak Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04783","snapshot_observed_at":"2026-08-12T12:56:34.447996Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.447996Z"},"links":{"cited_paper":"/paper/2403.04783","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:72751bc3062fdf794d2395c19bb2035caa9426d9d127536387a56d61cfdc2cd3","observation_id":"a0d05ba6-b761-453e-b545-d5a28031f29f","resolution":{"observed_at":"2026-08-12T12:56:34.447996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03644","last_updated":"2024-12-04T14:27:06Z","snapshot_observed_at":"2026-08-13T00:13:47.100961Z","submitted_at":"2024-05-06T17:07:28Z","title":"When LLMs Meet Cybersecurity: A Systematic Literature Review","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03644","snapshot_observed_at":"2026-08-12T12:56:34.451492Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.451492Z"},"links":{"cited_paper":"/paper/2405.03644","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:f897a579094ed8fd8c68dc12a24bfe2475c1096a8bbf53025db6671695f8a728","observation_id":"d01c5789-59dc-4e05-856c-23848654be2c","resolution":{"observed_at":"2026-08-12T12:56:34.451492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14023","last_updated":"2024-05-22T21:59:22Z","snapshot_observed_at":"2026-08-13T00:01:47.549602Z","submitted_at":"2024-05-22T21:59:22Z","title":"WordGame: Efficient & Effective LLM Jailbreak via Simultaneous Obfuscation in Query and Response","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14023","snapshot_observed_at":"2026-08-12T12:56:34.454996Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.454996Z"},"links":{"cited_paper":"/paper/2405.14023","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:01d01aff7292b543a042880efd4e8cbdde08a5ec742e9797ce7e59f1d5a5d603","observation_id":"c7477a0e-bf80-406d-b782-ed0162bd6fee","resolution":{"observed_at":"2026-08-12T12:56:34.454996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12171","last_updated":"2024-03-18T18:39:53Z","snapshot_observed_at":"2026-08-13T00:50:55.815580Z","submitted_at":"2024-03-18T18:39:53Z","title":"EasyJailbreak: A Unified Framework for Jailbreaking Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12171","snapshot_observed_at":"2026-08-12T12:56:34.458777Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.458777Z"},"links":{"cited_paper":"/paper/2403.12171","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:bb2fb85667cc3d5c706dc78cfe3fe440f286914175b2e7f7da5b8efd60262286","observation_id":"2d0b28b8-be7b-4318-871a-3bb55c5f972a","resolution":{"observed_at":"2026-08-12T12:56:34.458777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14857","last_updated":"2024-06-18T19:22:19Z","snapshot_observed_at":"2026-08-13T04:14:21.231623Z","submitted_at":"2024-02-20T17:39:40Z","title":"Is the System Message Really Important to Jailbreaks in Large Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14857","snapshot_observed_at":"2026-08-12T12:56:34.462384Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.462384Z"},"links":{"cited_paper":"/paper/2402.14857","citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:0c03222de8614830343eac8c6583fa314c6cc765a3d195b1f0100c4b7d8e4f23","observation_id":"f81234ec-f8fd-4741-81fa-e33964aa0016","resolution":{"observed_at":"2026-08-12T12:56:34.462384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:56:34.465844Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.465844Z"},"links":{"citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:972d96e6ad7de9282abdfcd9665858e069bd27cc41cb03f50d4aca5e70a4edf5","observation_id":"8b1a979d-a99f-4105-9f78-bc9f85690d09","resolution":{"observed_at":"2026-08-12T12:56:34.465844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T12:56:34.469917Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-12T12:56:34.469917Z"},"links":{"citing_paper":"/paper/2411.16642"},"observation_digest":"sha256:17e0eedc3cd77bccdb66d12b945167afd683b157675342eed8823ef18596ebd8","observation_id":"5d4d53ae-709e-4605-b19f-31cc668d1d07","resolution":{"observed_at":"2026-08-12T12:56:34.469917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.16642","last_updated":"2024-11-25T18:23:58Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-12T22:28:31.634087Z","submitted_at":"2024-11-25T18:23:58Z","title":"Preventing Jailbreak Prompts as Malicious Tools for Cybercriminals: A Cyber Defense Perspective"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2411.16642."}