{"as_of":"2026-08-08T02:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5f4f4f3de5868bbe815945d2d7d13082ecac37d69cd7db732668d76b01c6db36","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:42:44.726181Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:14:44.157020Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T15:46:13.475605Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.00391","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00391","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ff9caf06-a8c9-49e4-8aea-1a9277c554c3","year":2025},"citing_paper":{"arxiv_id":"2605.02946","last_updated":"2026-05-01T11:54:55Z","snapshot_observed_at":"2026-07-31T02:35:59.178763Z","submitted_at":"2026-05-01T11:54:55Z","title":"RouteHijack: Routing-Aware Attack on Mixture-of-Experts LLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-09T19:22:00.217729Z"},"links":{"cited_paper":"/paper/2509.00391","citing_paper":"/paper/2605.02946"},"observation_digest":"sha256:fbcef82d84963465cfd0006b6acdd6107b1cccc93f9aa038baaa3d695fa7ad06","observation_id":"1c7702fd-bb8f-40ae-8ca6-789fcfa5707d","resolution":{"observed_at":"2026-05-11T15:46:13.503101Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00391","snapshot_observed_at":"2026-08-07T00:14:44.157020Z","title":"arXiv preprint arXiv:2509.00391 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04034","last_updated":"2026-08-03T02:28:52Z","snapshot_observed_at":"2026-08-08T02:10:37.686663Z","submitted_at":"2026-08-03T02:28:52Z","title":"A Multimodal Automatic Redteaming Evaluation based on Atomic Jailbreak Strategy Decoupling and Combination","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-07T00:14:44.157020Z"},"links":{"cited_paper":"/paper/2509.00391","citing_paper":"/paper/2608.04034"},"observation_digest":"sha256:d9d150acc33b82864920b89ec7f34da641593ae8d8ff9b4a5385818ba2c4f383","observation_id":"eb205385-d4fc-44c4-a438-902b7d604b17","resolution":{"observed_at":"2026-08-07T00:14:44.157020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.00391/citation-record","integrity":"/paper/2509.00391/integrity","json":"/paper/2509.00391/citation-record.json","paper":"/paper/2509.00391"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.21972","last_updated":"2025-06-27T07:26:33Z","snapshot_observed_at":"2026-08-06T22:12:05.610333Z","submitted_at":"2025-06-27T07:26:33Z","title":"Advancing Jailbreak Strategies: A Hybrid Approach to Exploiting LLM Vulnerabilities and Bypassing Modern Defenses","version":1},"cited_work":{"arxiv_id":"2506.21972","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.21972","snapshot_observed_at":"2026-08-05T13:42:47.168376Z","title":"Advancing Jailbreak Strategies: A Hybrid Approach to Exploiting LLM Vulnerabilities and Bypassing Modern Defenses","venue":"cs.CL","work_id":"81389185-e650-40da-9add-6f539ba7768e","year":2025},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:40.816899Z"},"links":{"cited_paper":"/paper/2506.21972","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:e9e1bd052bd116e6478eaf61cdcf3bef4b9db0462ab9125de51efc6b2b31533d","observation_id":"0bcc39b1-b0b7-4a07-a44c-916e3f2bbd9c","resolution":{"observed_at":"2026-08-05T13:42:47.254201Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:47.947972Z","title":null,"venue":null,"work_id":"de11fa52-ed2d-43f4-8fad-9623511a474d","year":2025},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:40.859968Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:485e35bf0af62752e30273168cfbd4a4d0e4557bf15cc88c74c664582c5b69d6","observation_id":"c111128c-b059-4962-a054-0f69a9b18739","resolution":{"observed_at":"2026-08-05T13:42:47.992068Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-05T13:42:40.983858Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:40.983858Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:607486f941b3fd394268a2d7d118be60eeb676dbdeb09aba626d8aefc4ba9aeb","observation_id":"20465bc6-316f-4eef-b97d-bb628e8ec89f","resolution":{"observed_at":"2026-08-05T13:42:40.983858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-05T13:42:41.064925Z","title":"Bowman, Zac Hatfield-Dodds, Ben Mann, Dario Amodei, Nicholas Joseph, Sam McCandlish, Tom Brown, and Jared Kaplan","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:41.064925Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:609421948e20dd4ea210e6648dfc431effad2ff618f07853f8713a29ce3952d2","observation_id":"916208f7-8110-4192-ba46-8603212cc862","resolution":{"observed_at":"2026-08-05T13:42:41.064925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:41.144586Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:41.144586Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:2d580bd418576159622c6fe569c4e5b5d40967b80ef51834dc41df67a6e9cde0","observation_id":"6060e9d7-ea57-4912-8222-3fe76ec39c5f","resolution":{"observed_at":"2026-08-05T13:42:41.144586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:41.199306Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:41.199306Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:8a34cddac6a986b62eb262d1b0a89f830e3781dde5f8186db6003a9848192032","observation_id":"082fc47e-19d5-4bcd-9990-f2d52966ab87","resolution":{"observed_at":"2026-08-05T13:42:41.199306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T13:42:41.283321Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:41.283321Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:252d04d98123b5af6f7cbc5e8b6b439fd59e01cadd9522b077a444d82eb92143","observation_id":"a2a9994f-da70-4027-a470-dc77d9ac63d6","resolution":{"observed_at":"2026-08-05T13:42:41.283321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:47.915350Z","title":null,"venue":null,"work_id":"12b707b6-5a53-4d57-953f-31f158ba3e02","year":2024},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:41.370003Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:5079c3b8988cbe3ecaa9b0e85890fdfaa4436bf6dcb2308568ad7c7d875e8c40","observation_id":"1876780d-686d-4da0-b53a-6f6d9bf528b3","resolution":{"observed_at":"2026-08-05T13:42:47.920190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14375","last_updated":"2022-09-28T19:04:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-28T19:04:43Z","title":"Improving alignment of dialogue agents via targeted human judgements","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14375","snapshot_observed_at":"2026-08-05T13:42:41.494772Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:41.494772Z"},"links":{"cited_paper":"/paper/2209.14375","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:8b062f683573ed03e7dff3f544d5399eefa10bf2a553f0ff3425864c803a7675","observation_id":"2e2c3d42-b055-435f-ad16-b46d5f33c5d6","resolution":{"observed_at":"2026-08-05T13:42:41.494772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18864","last_updated":"2025-02-26T06:17:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T06:17:13Z","title":"Towards an AI co-scientist","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18864","snapshot_observed_at":"2026-08-05T13:42:41.579748Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:41.579748Z"},"links":{"cited_paper":"/paper/2502.18864","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:1309855daa4a2d0177cb8310e9353fa785ad7b30768a9d1e2dde675ef7be3524","observation_id":"13db7f75-9408-42ea-916d-f70d1f6dc824","resolution":{"observed_at":"2026-08-05T13:42:41.579748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12173","last_updated":"2023-05-05T14:26:17Z","snapshot_observed_at":"2026-07-06T14:55:08.682906Z","submitted_at":"2023-02-23T17:14:38Z","title":"Not what you've signed up for: Compromising Real-World LLM-Integrated Applications with Indirect Prompt Injection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12173","snapshot_observed_at":"2026-08-05T13:42:41.743849Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:41.743849Z"},"links":{"cited_paper":"/paper/2302.12173","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:3a979443e7d09c7b5317f24762b6bd00505d26862b46f102836bd70c9845d853","observation_id":"f3adae22-4988-4c04-86e4-965be5905ad1","resolution":{"observed_at":"2026-08-05T13:42:41.743849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:41.859762Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:41.859762Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:4b74c2b137e55de23d661fefe8fc62accf47808036f4a56d082bdc8e931fe1e2","observation_id":"f05a2baf-96d8-4c36-a9b3-f197648999c9","resolution":{"observed_at":"2026-08-05T13:42:41.859762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:41.998162Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:41.998162Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:3abe41160ef0f7a97475c9963cd955fe13802332dc1f732e1846e85a2203ba5f","observation_id":"17f21422-537b-4799-bffc-ac2e45063bdb","resolution":{"observed_at":"2026-08-05T13:42:41.998162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05197","last_updated":"2023-11-01T05:14:01Z","snapshot_observed_at":"2026-07-06T15:14:24.794122Z","submitted_at":"2023-04-11T13:05:04Z","title":"Multi-step Jailbreaking Privacy Attacks on ChatGPT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05197","snapshot_observed_at":"2026-08-05T13:42:42.111230Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:42.111230Z"},"links":{"cited_paper":"/paper/2304.05197","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:df441ad7fac5c068b7d8e4f947771e85f1d4aa152f9013e351cc81dfc46de7ad","observation_id":"0531ff80-7e34-4b9b-9aa5-b094f3650f56","resolution":{"observed_at":"2026-08-05T13:42:42.111230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08615","last_updated":"2024-12-16T04:05:45Z","snapshot_observed_at":"2026-07-06T20:05:28.003434Z","submitted_at":"2024-12-11T18:37:56Z","title":"Exploiting the Index Gradients for Optimization-Based Jailbreaking on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08615","snapshot_observed_at":"2026-08-05T13:42:42.181765Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:42.181765Z"},"links":{"cited_paper":"/paper/2412.08615","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:1e4484194db1c0225f36dbc617463331bd5f753b1125b1a18eb68d80a780cbcc","observation_id":"47f84449-ad03-4c1c-b67c-8506fb2f65a6","resolution":{"observed_at":"2026-08-05T13:42:42.181765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20778","last_updated":"2024-11-01T09:53:53Z","snapshot_observed_at":"2026-08-05T08:25:58.948449Z","submitted_at":"2024-05-28T06:10:12Z","title":"Improved Generation of Adversarial Examples Against Safety-aligned LLMs","version":2},"cited_work":{"arxiv_id":"2405.20778","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.20778","snapshot_observed_at":"2026-08-05T13:42:46.417626Z","title":"Improved Generation of Adversarial Examples Against Safety-aligned LLMs","venue":"cs.CR","work_id":"1d3e2b25-e697-40ff-bab8-6622e3c69715","year":2024},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:42.274991Z"},"links":{"cited_paper":"/paper/2405.20778","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:afe3c4d3bebf7411720c6a6fe9b1d8ed33796c9ec646ee92e6f1c80861358cff","observation_id":"dc258217-2310-4236-a330-9837b676b645","resolution":{"observed_at":"2026-08-05T13:42:46.565966Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07921","last_updated":"2024-11-24T18:03:43Z","snapshot_observed_at":"2026-08-08T01:20:41.374144Z","submitted_at":"2024-04-11T17:05:50Z","title":"AmpleGCG: Learning a Universal and Transferable Generative Model of Adversarial Suffixes for Jailbreaking Both Open and Closed LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07921","snapshot_observed_at":"2026-08-05T13:42:42.354168Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:42.354168Z"},"links":{"cited_paper":"/paper/2404.07921","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:cbe955e827e53cb4094a25801c756f29a077261ab981abf328f3d2437e88a03b","observation_id":"b7803054-ae29-4c7d-9bf6-d4ae29b722f6","resolution":{"observed_at":"2026-08-05T13:42:42.354168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13348","last_updated":"2025-05-19T16:51:12Z","snapshot_observed_at":"2026-08-07T15:43:02.290688Z","submitted_at":"2025-05-19T16:51:12Z","title":"Investigating the Vulnerability of LLM-as-a-Judge Architectures to Prompt-Injection Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13348","snapshot_observed_at":"2026-08-05T13:42:42.492282Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:42.492282Z"},"links":{"cited_paper":"/paper/2505.13348","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:2e8f6be744be5114c195c30de84be80dbbe60ba9745d0368a9f8bec6bddd44d4","observation_id":"e7ab25f3-09de-41ed-bfe9-6f0e379cc14f","resolution":{"observed_at":"2026-08-05T13:42:42.492282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-05T13:42:42.599759Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:42.599759Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:9e222e4d8d50fc9cf602c0f882ca4ca498966872ef97c7e5029cff6fc44405dc","observation_id":"f60a8c05-d0a3-476c-98af-5c95fdf807a1","resolution":{"observed_at":"2026-08-05T13:42:42.599759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03442","last_updated":"2023-08-06T00:21:19Z","snapshot_observed_at":"2026-07-06T15:13:13.695535Z","submitted_at":"2023-04-07T01:55:19Z","title":"Generative Agents: Interactive Simulacra of Human Behavior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03442","snapshot_observed_at":"2026-08-05T13:42:42.666547Z","title":"O’Brien, Carrie J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:42.666547Z"},"links":{"cited_paper":"/paper/2304.03442","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:3ab6c1801b0a6705794c914ecde7ad640448266988816227ea1257de90f0fba6","observation_id":"9ab1f673-931c-4c04-8411-d0bf834af4be","resolution":{"observed_at":"2026-08-05T13:42:42.666547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:47.804007Z","title":"Logan IV, Eric Wallace, and Sameer Singh","venue":null,"work_id":"7422dbfc-cc19-4196-bf14-93c27f910144","year":2020},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:42.810300Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:5b83f6e4a635b3fd815859795a5717ef5b484433cb3ab5e52d528a5ceb116974","observation_id":"4f3277d5-3526-49d9-a2ce-639a15a8ce62","resolution":{"observed_at":"2026-08-05T13:42:47.856231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:43.000247Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:43.000247Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:7d4b12460971feff1dfa14edb4f244887bbe5df0bca4d48dae8944fa3c40f21b","observation_id":"1ccaa2a2-0a3d-49ff-8618-f0bbb7563423","resolution":{"observed_at":"2026-08-05T13:42:43.000247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09674","last_updated":"2024-02-15T02:54:49Z","snapshot_observed_at":"2026-08-07T20:57:20.578029Z","submitted_at":"2024-02-15T02:54:49Z","title":"PAL: Proxy-Guided Black-Box Attack on Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09674","snapshot_observed_at":"2026-08-05T13:42:43.183386Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:43.183386Z"},"links":{"cited_paper":"/paper/2402.09674","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:b209a7f56c39ad5ffa6440caa32446a3769f3055ce556ed92ec91b2e854e3a6a","observation_id":"c527a82b-0926-4edf-b467-e9169c2ecfd7","resolution":{"observed_at":"2026-08-05T13:42:43.183386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:43.269955Z","title":"Bulaong, John E","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:43.269955Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:735ed9f554b09258e307b075c853c8b110b952ced10fcbc2a6898f255b1ffae7","observation_id":"70357e95-719c-435d-8f66-0d1cc8f490e7","resolution":{"observed_at":"2026-08-05T13:42:43.269955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17447","last_updated":"2024-10-01T17:39:09Z","snapshot_observed_at":"2026-08-05T21:10:40.349698Z","submitted_at":"2024-07-24T17:23:18Z","title":"FLRT: Fluent Student-Teacher Redteaming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17447","snapshot_observed_at":"2026-08-05T13:42:43.367407Z","title":"Ben Thompson and Michael Sklar","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:43.367407Z"},"links":{"cited_paper":"/paper/2407.17447","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:98e7ead65ce8cc24617e82b9111c485d11491084cfb0f946f0e6b5555eca9dd8","observation_id":"169178dc-4d6e-4f27-a0bf-a05787948532","resolution":{"observed_at":"2026-08-05T13:42:43.367407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T13:42:43.478286Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:43.478286Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:57bd3c7f53a1d73fecd5e2c151c635a330a6ba5a017cf5ffdaa0ca4066da2c03","observation_id":"365ecbfa-eed7-4d00-aa16-c6809c3d3bd1","resolution":{"observed_at":"2026-08-05T13:42:43.478286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00925","last_updated":"2024-08-01T21:28:27Z","snapshot_observed_at":"2026-07-06T18:55:49.577776Z","submitted_at":"2024-08-01T21:28:27Z","title":"WHITE PAPER: A Brief Exploration of Data Exfiltration using GCG Suffixes","version":1},"cited_work":{"arxiv_id":"2408.00925","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.00925","snapshot_observed_at":"2026-08-05T13:42:45.934017Z","title":"WHITE PAPER: A Brief Exploration of Data Exfiltration using GCG Suffixes","venue":"cs.CR","work_id":"396e5a10-3563-4a59-8cb7-81325815d159","year":2024},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:43.557990Z"},"links":{"cited_paper":"/paper/2408.00925","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:ca75256bad276120bd4240bea977f82246c7c7ffda6ced2e5db5f10ac3b521c3","observation_id":"865529e1-591c-4f61-99b4-513f7013c464","resolution":{"observed_at":"2026-08-05T13:42:46.121557Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.06151","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:45.633511Z","title":null,"venue":null,"work_id":"1be3ac56-4fe0-41f4-b5b7-cb9ef1c3179d","year":2025},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:43.659509Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:24ba371f50023ef5a1412e7e7738dc8e94c50a50ac6b9ffb63770e72486291df","observation_id":"a7b6bf59-5291-4bb5-93b0-b8bd873663d1","resolution":{"observed_at":"2026-08-05T13:42:45.723511Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:47.654575Z","title":null,"venue":null,"work_id":"ff39e4d1-1952-4cc1-83e9-e5514c722e5c","year":2023},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:43.729897Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:b5ded88b7f80237993d484b7c48b4ac26aeca27b18e1515ab311468367d68539","observation_id":"1d431f75-4979-4989-b876-eda7492bd16d","resolution":{"observed_at":"2026-08-05T13:42:47.763635Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06502","last_updated":"2025-04-29T19:03:48Z","snapshot_observed_at":"2026-08-04T09:24:11.372328Z","submitted_at":"2024-08-12T21:35:59Z","title":"Prompt Recovery for Image Generation Models: A Comparative Study of Discrete Optimizers","version":2},"cited_work":{"arxiv_id":"2408.06502","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.06502","snapshot_observed_at":"2026-08-05T13:42:45.277170Z","title":"Prompt Recovery for Image Generation Models: A Comparative Study of Discrete Optimizers","venue":"cs.CV","work_id":"0a278b17-aa19-42ad-9d17-474fe8e54b0f","year":2024},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:43.863873Z"},"links":{"cited_paper":"/paper/2408.06502","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:0ca83e7cffae1dc1ea42411cfaa90121d02f5cc10c99fbc310dd67e2c13f2ae5","observation_id":"b67a23b6-20f3-40b4-9a47-9558a7daf410","resolution":{"observed_at":"2026-08-05T13:42:45.413102Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15362","last_updated":"2026-05-19T04:19:17Z","snapshot_observed_at":"2026-07-06T19:36:36.994783Z","submitted_at":"2024-10-20T11:27:41Z","title":"Faster-GCG: Efficient Discrete Optimization Jailbreak Attacks against Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15362","snapshot_observed_at":"2026-08-05T13:42:43.987849Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:43.987849Z"},"links":{"cited_paper":"/paper/2410.15362","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:d66a2d531328e4d584261687965aa955c90fb7173d4bf6f1a96d140815f58d4b","observation_id":"e1ee8659-721f-4c0e-b7d3-4ba5c4c6f713","resolution":{"observed_at":"2026-08-05T13:42:43.987849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:44.099167Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:44.099167Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:4d253fdae5c9fc863ed1a7bd81e31c75a2dead7527f0b86ec631dbda2cf1575f","observation_id":"15bc2769-1b9b-4a25-8177-712ccbd7c7c4","resolution":{"observed_at":"2026-08-05T13:42:44.099167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:44.187781Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:44.187781Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:c2bdd27842fd06cd455763e0aa9a3bb6957d68c1bccc5b8b139f218e26ebb30a","observation_id":"eb3cee9b-07c7-4dda-bed4-6efbe440a3fd","resolution":{"observed_at":"2026-08-05T13:42:44.187781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-05T13:42:44.305192Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:44.305192Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:6ea01d5d4d67ef779777194031cecd81b3783708d22361723216ffb510ac2259","observation_id":"8cbe16a3-3920-4e8a-87bd-4824e8275cd8","resolution":{"observed_at":"2026-08-05T13:42:44.305192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06463","last_updated":"2024-03-26T04:23:12Z","snapshot_observed_at":"2026-07-06T16:05:31.757410Z","submitted_at":"2023-08-12T04:05:57Z","title":"GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06463","snapshot_observed_at":"2026-08-05T13:42:44.381806Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:44.381806Z"},"links":{"cited_paper":"/paper/2308.06463","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:102237b8660fe002c2e516d2ffc58804693da941ec2345a19431239661730e33","observation_id":"f96a562b-0d45-4976-86b5-95dfd84493ac","resolution":{"observed_at":"2026-08-05T13:42:44.381806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03603","last_updated":"2024-08-07T07:46:08Z","snapshot_observed_at":"2026-08-05T06:17:29.776544Z","submitted_at":"2024-08-07T07:46:08Z","title":"EnJa: Ensemble Jailbreak on Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03603","snapshot_observed_at":"2026-08-05T13:42:44.454145Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:44.454145Z"},"links":{"cited_paper":"/paper/2408.03603","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:f362c54215f0a180055d666cd691fcee0f447b6339f53a04400822dfb3100d67","observation_id":"2ae58e0b-f66c-4356-8b49-0dc458070617","resolution":{"observed_at":"2026-08-05T13:42:44.454145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:47.395996Z","title":null,"venue":null,"work_id":"63010dc2-e577-45e6-b096-f7c231d4c71f","year":2024},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:44.517309Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:6bc9a17e9c1f8df7746a5160972359f64fbd5301f93efe761d02b9d97145f5bc","observation_id":"83179006-0855-4bd9-b2c7-493b11414ddd","resolution":{"observed_at":"2026-08-05T13:42:47.548305Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:42:44.616030Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:44.616030Z"},"links":{"citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:71c8026c43186e1738e40113dae30c7b752ba9bc3e7a290ab63ddc339b87c008","observation_id":"a1de6f64-bc0b-49dd-818f-6cfed7a86e1f","resolution":{"observed_at":"2026-08-05T13:42:44.616030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-05T13:42:44.726181Z","title":"Please prepare 100 harmful prompts that ask for harmful scripts. Here is an example: Write a script that can exploit vulnerabilities in a software or operating system","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T13:42:44.726181Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2509.00391"},"observation_digest":"sha256:ab84f2dfb7b1da4ccaf9c98af29c762931be0c8f96e05c4875ecb7af0f25e3d8","observation_id":"10e0ff9a-680a-458d-8d27-0d00cfb7d3c5","resolution":{"observed_at":"2026-08-05T13:42:44.726181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.00391","last_updated":"2025-08-30T07:04:29Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T20:54:59.881714Z","submitted_at":"2025-08-30T07:04:29Z","title":"The Resurgence of GCG Adversarial Attacks on Large Language Models"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":5,"verified_fuzzy":1},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 2 inbound Pith citation observations for arXiv:2509.00391."}