{"as_of":"2026-08-09T23:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f9d9875bf9c3cc385b2a28b0d96f241fb966db3f79e9e31b3e61845bbf8ee89f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T04:22:00.465363Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T19:00:30.340656Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.01446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":"153226da-2665-4072-9525-a1b0e29db394","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:6090c0c61e4238dbbf54396404b31c628ea6b9203cc249acd1253f9c902cffa1","observation_id":"a9e0449a-d2cf-4d77-a059-af389bc5cba1","resolution":{"observed_at":"2026-05-17T09:24:14.027167Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.01446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":"153226da-2665-4072-9525-a1b0e29db394","year":2023},"citing_paper":{"arxiv_id":"2401.05561","last_updated":"2024-09-30T10:17:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-10T22:07:21Z","title":"TrustLLM: Trustworthiness in Large Language Models","version":6},"reference_index":245,"source":"pdf_text","source_observed_at":"2026-05-18T11:17:08.108565Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2401.05561"},"observation_digest":"sha256:574dbcc4c19dbb4467454b3e29a593775824c8ae0a4680538e3ddb8c6fe852f2","observation_id":"391b345f-5beb-46e7-9578-5914dc60264a","resolution":{"observed_at":"2026-05-18T11:17:08.691983Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.01446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":"153226da-2665-4072-9525-a1b0e29db394","year":2023},"citing_paper":{"arxiv_id":"2402.10260","last_updated":"2024-08-27T03:32:47Z","snapshot_observed_at":"2026-08-04T21:32:35.483431Z","submitted_at":"2024-02-15T18:58:09Z","title":"A StrongREJECT for Empty Jailbreaks","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T21:28:02.745230Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2402.10260"},"observation_digest":"sha256:c4015b6eeca26799bed97c22cbf9c0044d7d815a5a676c0b4d7f6fd8e3e98839","observation_id":"6755de70-5077-48ad-bdfc-2a14518faf4b","resolution":{"observed_at":"2026-05-16T21:28:02.830434Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.01446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":"153226da-2665-4072-9525-a1b0e29db394","year":2023},"citing_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-02T14:59:12.115203Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-15T06:08:05.386345Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2404.01318"},"observation_digest":"sha256:c96f5c309dffcf7d50958aef2f27a2ceb7324926eeed0680131adb310c99986f","observation_id":"fb3e3ded-af34-448d-8780-349c26f73a04","resolution":{"observed_at":"2026-05-15T06:08:05.637785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.01446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":"153226da-2665-4072-9525-a1b0e29db394","year":2023},"citing_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-04T23:34:13.332065Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-15T02:20:44.368219Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2407.04295"},"observation_digest":"sha256:de52e0714771c79962376f3ff1aba098289b9ce807852587310c9cd217b29806","observation_id":"45ced3d8-724b-4da4-a873-530e46cf695c","resolution":{"observed_at":"2026-05-15T02:20:44.705732Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-08-09T04:22:00.465363Z","title":"Open Sesame ! Universal Black Box Jailbreaking of Large Language Models , November 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05223","last_updated":"2025-02-05T21:50:34Z","snapshot_observed_at":"2026-08-09T05:14:54.791831Z","submitted_at":"2025-02-05T21:50:34Z","title":"KDA: A Knowledge-Distilled Attacker for Generating Diverse Prompts to Jailbreak LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:00.465363Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2502.05223"},"observation_digest":"sha256:7d8eda04f71043123dbdb7ce5071d8b704e97404837eba2df01802b125fd2809","observation_id":"d9172f6b-7dbe-4588-9038-23b5edfb9671","resolution":{"observed_at":"2026-08-09T04:22:00.465363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.01446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":"153226da-2665-4072-9525-a1b0e29db394","year":2023},"citing_paper":{"arxiv_id":"2502.18864","last_updated":"2025-02-26T06:17:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T06:17:13Z","title":"Towards an AI co-scientist","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-11T13:02:43.571234Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2502.18864"},"observation_digest":"sha256:c2fe57efebd5e6bcc9dd307cf823a77d2e3df73208da7994d2c74ba8292e4948","observation_id":"5d779aee-93d4-485b-b0e5-2ed58e4f5896","resolution":{"observed_at":"2026-05-11T13:02:44.303435Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-08-07T15:15:48.657664Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15753","last_updated":"2025-05-21T16:58:14Z","snapshot_observed_at":"2026-08-07T15:09:59.174634Z","submitted_at":"2025-05-21T16:58:14Z","title":"Scalable Defense against In-the-wild Jailbreaking Attacks with Safety Context Retrieval","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:48.657664Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2505.15753"},"observation_digest":"sha256:75acf65f6953c077dff91d58e83323e5c44ac0d2da9255165569e98fc8e58f49","observation_id":"5df0e263-d0cd-4aa3-ae20-573e45d7e151","resolution":{"observed_at":"2026-08-07T15:15:48.657664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-08-07T14:32:29.722321Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18556","last_updated":"2025-08-25T00:27:19Z","snapshot_observed_at":"2026-08-07T23:15:35.522697Z","submitted_at":"2025-05-24T06:47:32Z","title":"Exploring the Vulnerability of the Content Moderation Guardrail in Large Language Models via Intent Manipulation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:29.722321Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2505.18556"},"observation_digest":"sha256:588320f5dcaeebcb924778461b1380e5979ab6101a0034871d20292a8215455d","observation_id":"9820e81e-1a97-4abd-9d41-c424982aea51","resolution":{"observed_at":"2026-08-07T14:32:29.722321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.01446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":"153226da-2665-4072-9525-a1b0e29db394","year":2023},"citing_paper":{"arxiv_id":"2506.12382","last_updated":"2026-04-27T08:32:16Z","snapshot_observed_at":"2026-08-02T04:53:57.144183Z","submitted_at":"2025-06-14T07:31:52Z","title":"Exploring the Secondary Risks of Large Language Models","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T09:40:58.067398Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2506.12382"},"observation_digest":"sha256:260f0ce6b5c44fd9074c30726b05e51342bf3ea773beac369e69372be0941908","observation_id":"6a40cea9-ec0b-4f07-8e47-c32fc995deac","resolution":{"observed_at":"2026-05-19T09:42:13.982380Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.01446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":"153226da-2665-4072-9525-a1b0e29db394","year":2023},"citing_paper":{"arxiv_id":"2506.17299","last_updated":"2026-04-24T04:36:54Z","snapshot_observed_at":"2026-08-02T14:45:34.223522Z","submitted_at":"2025-06-17T20:37:29Z","title":"Toward Principled LLM Safety Testing: Solving the Jailbreak Oracle Problem","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-19T08:40:56.186349Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2506.17299"},"observation_digest":"sha256:bddbb7472019f2eb2d793a63f931c552aaef94e4f3edc3b08481c0c37348913a","observation_id":"fdeb4338-48e7-4788-a7ae-2b939a1f1ff5","resolution":{"observed_at":"2026-05-19T08:42:12.843952Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-08-06T22:07:03.747430Z","title":"Open sesame! universal black box jailbreaking of large language models.arXiv preprint arXiv:2309.01446, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-06T21:58:37.734178Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:03.747430Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:d1d34e854099049d03fecd7c8bac38611ec2d3e360bf32c46fd4889b8f93c8bf","observation_id":"fd629e92-463b-4d93-bd3f-e286209cb7df","resolution":{"observed_at":"2026-08-06T22:07:03.747430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-08-06T17:35:48.251121Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14202","last_updated":"2025-07-14T17:41:12Z","snapshot_observed_at":"2026-08-08T03:22:49.699348Z","submitted_at":"2025-07-14T17:41:12Z","title":"PRM-Free Security Alignment of Large Models via Red Teaming and Adversarial Training","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T17:35:48.251121Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2507.14202"},"observation_digest":"sha256:05457a8f3047abe7b31b4d98c9173629f57272628b3847a82fd9db5a27ec763a","observation_id":"8e39d5a0-df53-4a41-813c-fd6d04b2881a","resolution":{"observed_at":"2026-08-06T17:35:48.251121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-08-05T20:31:42.141679Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10404","last_updated":"2025-08-14T07:12:44Z","snapshot_observed_at":"2026-08-08T02:31:17.622343Z","submitted_at":"2025-08-14T07:12:44Z","title":"Layer-Wise Perturbations via Sparse Autoencoders for Adversarial Text Generation","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:42.141679Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2508.10404"},"observation_digest":"sha256:3ff6120cc6fe3173844d31aa83abd6e0faca743363830fbba7b20afbf162d400","observation_id":"a3f44fa2-acd8-4f49-8551-f7f32084e4ed","resolution":{"observed_at":"2026-08-05T20:31:42.141679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-08-04T12:27:28.685472Z","title":"Open sesame! universal black-box jailbreaking of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.03520","last_updated":"2026-06-10T17:21:57Z","snapshot_observed_at":"2026-08-07T07:08:30.567791Z","submitted_at":"2025-10-03T21:24:41Z","title":"Certifiable Safe RLHF: Semantic Grounding and Fixed Penalty Constraint Optimization for Safer LLM Alignment","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T12:27:28.685472Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2510.03520"},"observation_digest":"sha256:73c87b7278abd79dc8d0527d6ce944a4d97e3f93003cf972741c966e526a3e51","observation_id":"fa71d631-b006-417e-b74d-85248c6a3edb","resolution":{"observed_at":"2026-08-04T12:27:28.685472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-08-04T09:25:45.557792Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.15476","last_updated":"2026-07-04T04:20:15Z","snapshot_observed_at":"2026-08-06T02:45:04.316908Z","submitted_at":"2025-10-17T09:38:54Z","title":"SoK: Systematizing LLM Prompt Security: Taxonomies, Datasets, and Unified Evaluation of Attacks and Defenses","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-04T09:25:45.557792Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2510.15476"},"observation_digest":"sha256:815a364b3af16a1faff185000e35889604918becc6367c609c1b138f1fde9c35","observation_id":"8ab876c1-6575-4d55-b711-3fb3217f109b","resolution":{"observed_at":"2026-08-04T09:25:45.557792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.01446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":"153226da-2665-4072-9525-a1b0e29db394","year":2023},"citing_paper":{"arxiv_id":"2511.12710","last_updated":"2026-05-18T06:50:41Z","snapshot_observed_at":"2026-07-06T22:35:55.936840Z","submitted_at":"2025-11-16T17:52:07Z","title":"Evolve the Method, Not the Prompts: Evolutionary Synthesis of Jailbreak Attacks on LLMs","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T18:58:53.183734Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2511.12710"},"observation_digest":"sha256:a21fec0e794a558eee3c163c9e5ddc037e69771e1af501ccb683608b406ec490","observation_id":"73840eff-dd60-4c1d-a220-9fdc976e666e","resolution":{"observed_at":"2026-05-21T19:00:30.342867Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.01446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":"153226da-2665-4072-9525-a1b0e29db394","year":2023},"citing_paper":{"arxiv_id":"2602.11528","last_updated":"2026-04-18T03:07:48Z","snapshot_observed_at":"2026-07-06T22:45:34.674215Z","submitted_at":"2026-02-12T03:37:50Z","title":"Stop Tracking Me! Proactive Defense Against Attribute Inference Attack in LLMs","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T05:22:59.050348Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2602.11528"},"observation_digest":"sha256:1b763a558e362809cee4240382f15afaafefae5d76ff995e7cdd8ee6595933e0","observation_id":"68043072-bda3-480b-a46b-c56692804f02","resolution":{"observed_at":"2026-05-16T05:27:23.277446Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.01446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":"153226da-2665-4072-9525-a1b0e29db394","year":2023},"citing_paper":{"arxiv_id":"2604.11309","last_updated":"2026-04-13T11:12:30Z","snapshot_observed_at":"2026-07-30T17:13:57.164751Z","submitted_at":"2026-04-13T11:12:30Z","title":"The Salami Slicing Threat: Exploiting Cumulative Risks in LLM Systems","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T16:07:31.602378Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2604.11309"},"observation_digest":"sha256:445cef2c05bdc5baf1a231766dd6a9009689db60b42b58b882ff183a7a25d118","observation_id":"036a0ae2-1003-4bc5-a3b7-752b02ea33b5","resolution":{"observed_at":"2026-05-11T09:16:04.331000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.01446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":"153226da-2665-4072-9525-a1b0e29db394","year":2023},"citing_paper":{"arxiv_id":"2604.23130","last_updated":"2026-06-16T20:40:27Z","snapshot_observed_at":"2026-07-06T23:09:23.591544Z","submitted_at":"2026-04-25T03:54:03Z","title":"From Concept-Aligned Tokens to Vulnerable Features: Mechanistic Localization of Jailbreaks","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-08T08:27:28.848271Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2604.23130"},"observation_digest":"sha256:f147ce722f36fe01a61bd656ef4cc8dd3ec5768c60b2245301d76dbc0554ce11","observation_id":"2bd2d478-cd8b-427f-b55e-49ff8614630b","resolution":{"observed_at":"2026-05-11T20:36:11.253480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2309.01446/citation-record","integrity":"/paper/2309.01446/integrity","json":"/paper/2309.01446/citation-record.json","paper":"/paper/2309.01446"},"outbound":[],"paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T21:02:05.722226Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2309.01446."}