{"as_of":"2026-08-24T03:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8d0aec63a02d6dbd725f1bb7b3ac4dbc41ff2b6e4e7402b722335caf3e558add","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:07:05.950247Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:02:38.279815Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.22666","snapshot_observed_at":"2026-08-04T09:02:38.279815Z","title":"Vera: Variational inference framework for jailbreaking large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.17759","last_updated":"2026-05-26T07:09:27Z","snapshot_observed_at":"2026-08-16T08:28:22.520272Z","submitted_at":"2025-10-20T17:12:10Z","title":"VERA-V: Variational Inference Framework for Jailbreaking Vision-Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T09:02:38.279815Z"},"links":{"cited_paper":"/paper/2506.22666","citing_paper":"/paper/2510.17759"},"observation_digest":"sha256:c50248e67b11f0cb1798fbce3d74da4f413d02f50b671c49fcdc03740c7910eb","observation_id":"81994794-73d5-4737-902b-fadf39160117","resolution":{"observed_at":"2026-08-04T09:02:38.279815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"cited_work":{"arxiv_id":"2506.22666","doi":"10.48550/arxiv.2506.22666","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.22666","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2506.22666 , abstract =","venue":"ArXiv.org","work_id":"42a41d55-66d4-46e0-b051-52ceb1c5113f","year":null},"citing_paper":{"arxiv_id":"2605.12813","last_updated":"2026-05-31T17:51:51Z","snapshot_observed_at":"2026-08-20T19:02:09.543322Z","submitted_at":"2026-05-12T23:13:50Z","title":"REALISTA: Realistic Latent Adversarial Attacks that Elicit LLM Hallucinations","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-14T20:13:10.814899Z"},"links":{"cited_paper":"/paper/2506.22666","citing_paper":"/paper/2605.12813"},"observation_digest":"sha256:4e3ff4b0a8a6ff2569b85200c93f1cc412546af758afa5592f1ddb13dcf4a4b8","observation_id":"39620d19-2d53-4108-889e-d787eab65447","resolution":{"observed_at":"2026-06-02T02:03:32.460855Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.22666/citation-record","integrity":"/paper/2506.22666/integrity","json":"/paper/2506.22666/citation-record.json","paper":"/paper/2506.22666"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.14132","last_updated":"2023-11-07T03:30:15Z","snapshot_observed_at":"2026-08-15T21:55:47.604051Z","submitted_at":"2023-08-27T15:20:06Z","title":"Detecting Language Model Attacks with Perplexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14132","snapshot_observed_at":"2026-08-06T22:07:02.078798Z","title":"Detecting language model attacks with perplexity, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:02.078798Z"},"links":{"cited_paper":"/paper/2308.14132","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:40b185fb7085cf5e9a2ffd7b73c813126164b66ba6be8b42fe20c1cf9981c2d0","observation_id":"676e7084-78ed-4584-a381-53603cdc4122","resolution":{"observed_at":"2026-08-06T22:07:02.078798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:09.117055Z","title":"EBGCG: Effective white-box jailbreak attack against large language model","venue":null,"work_id":"04925faa-f03d-4024-9b6a-2bf9171054ce","year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:02.136767Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:3307ea970c780b88b85c1f99bed17a989f6bb0f64951893419d4ca0dff6e365d","observation_id":"c6bd6401-67b4-43a5-abdd-e01326bad9b3","resolution":{"observed_at":"2026-08-06T22:07:09.183393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:02.212683Z","title":"Defending against alignment-breaking attacks via robustly aligned LLM","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:02.212683Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:fb760a48c0cdec07b4176a470a71cbbd599d6942414c1ce2e81666176ae35f74","observation_id":"0c61c9f2-af87-4c16-8047-064c919c0a9c","resolution":{"observed_at":"2026-08-06T22:07:02.212683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:02.299573Z","title":"Pappas, and Eric Wong","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:02.299573Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:b1075ffff681f443428a6cc7a5c9ae515fa621e23744ea0389f9e257b4592f09","observation_id":"977d1c23-e786-4c0c-84e0-d98c291d8918","resolution":{"observed_at":"2026-08-06T22:07:02.299573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08705","last_updated":"2025-01-27T06:25:47Z","snapshot_observed_at":"2026-08-16T13:43:32.344232Z","submitted_at":"2024-06-13T00:04:15Z","title":"When LLM Meets DRL: Advancing Jailbreaking Efficiency via DRL-guided Search","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08705","snapshot_observed_at":"2026-08-06T22:07:02.370312Z","title":"When llm meets drl: Advancing jailbreaking efficiency via drl-guided search.arXiv preprint arXiv:2406.08705, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:02.370312Z"},"links":{"cited_paper":"/paper/2406.08705","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:5aeebcbfca3906da37cfed7846c781231af2134f2b38a98cd8b6bc4a4c031fe9","observation_id":"2d484145-67b1-4bd1-b864-0859030bb037","resolution":{"observed_at":"2026-08-06T22:07:02.370312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:08.935372Z","title":"When LLM meets DRL: Advancing jailbreaking efficiency via DRL-guided search","venue":null,"work_id":"866a0f15-5049-4a5c-a265-a4c6137c47b4","year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:02.481225Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:65f157b1a32546ad99d0fa313b81d12ab4a4101df1f08b6e976e19860f3bcc16","observation_id":"caad69f5-a76e-4469-a3b6-353167723adf","resolution":{"observed_at":"2026-08-06T22:07:08.997640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08725","last_updated":"2024-06-13T01:05:22Z","snapshot_observed_at":"2026-08-16T13:43:31.777372Z","submitted_at":"2024-06-13T01:05:22Z","title":"RL-JACK: Reinforcement Learning-powered Black-box Jailbreaking Attack against LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08725","snapshot_observed_at":"2026-08-06T22:07:02.583100Z","title":"Rl-jack: Reinforcement learning-powered black-box jailbreaking attack against llms.arXiv preprint arXiv:2406.08725, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:02.583100Z"},"links":{"cited_paper":"/paper/2406.08725","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:6a1433d138c0becf2349a6f4ca680cc5e7ab1788d776b42eaaa2e249efaaf22f","observation_id":"98a71be8-0944-4049-92ef-4250b9fb730f","resolution":{"observed_at":"2026-08-06T22:07:02.583100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:08.758939Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":"e7d3c46f-036e-47e9-b50b-1706bf9ce07f","year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:02.700740Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:a96f2a3f00f00c2ff0b084a6c189021e9490237964ff729800f6f783842998ee","observation_id":"2d2f61be-29ca-48ab-b415-e44f3cb04c83","resolution":{"observed_at":"2026-08-06T22:07:08.843374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:08.580701Z","title":"Gradient-based ad- versarial attacks against text transformers","venue":null,"work_id":"1241b3bf-9097-40cc-bec6-9322cf5ba248","year":2021},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:02.791522Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:fdd6cda145c41f734c4dcdf11c3ff407a927c327457d24904e06b3d912e7f315","observation_id":"cf79e1f4-7f72-48be-b330-b8639ade7976","resolution":{"observed_at":"2026-08-06T22:07:08.689727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.13733","last_updated":"2021-04-15T17:43:43Z","snapshot_observed_at":"2026-08-18T17:44:28.600464Z","submitted_at":"2021-04-15T17:43:43Z","title":"Gradient-based Adversarial Attacks against Text Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.13733","snapshot_observed_at":"2026-08-06T22:07:02.869101Z","title":"Gradient-based adversarial attacks against text transformers.arXiv preprint arXiv:2104.13733, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:02.869101Z"},"links":{"cited_paper":"/paper/2104.13733","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:53f65a34df79a2e6ae5863efcfe43b6021c0df77d6d866bcc91080f455b9c620","observation_id":"1d96cd72-a7d0-43b6-a1d7-c47a8e75fc9f","resolution":{"observed_at":"2026-08-06T22:07:02.869101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:08.404433Z","title":"Cold-attack: Jailbreaking llms with stealthiness and controllability, 2024","venue":null,"work_id":"3c934493-4866-47f2-8d2e-fec9d6ad70c5","year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:02.996101Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:cef6f003861b92408980d0111eea27f7639c89feec3d805b24fc4561cc3f0abe","observation_id":"200da9ed-4310-45f5-abf8-fb969f913bd7","resolution":{"observed_at":"2026-08-06T22:07:08.485513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:03.109822Z","title":"Lora: Low-rank adaptation of large language models.ICLR, 1 (2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:03.109822Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:73e979cd477c970521bd766fd510c39ab2737b1a031479dfea3b17ff5f236e10","observation_id":"2a9675dc-d2f9-473d-be36-b20a782f84a2","resolution":{"observed_at":"2026-08-06T22:07:03.109822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-08-14T15:42:19.849118Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T22:07:03.267607Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations.arXiv preprint arXiv:2312.06674, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:03.267607Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:c962538f96b0db50f82cbedaf0ebeab5af5a69f16a6b187b4da8fffb65f54d79","observation_id":"47456cfa-c3cc-4b83-a3f7-3921fdbc22c4","resolution":{"observed_at":"2026-08-06T22:07:03.267607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-06T22:07:03.471458Z","title":"Baseline defenses for adversarial attacks against aligned language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:03.471458Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:895813237dc6f97e4457381543406defc02018e168a6181970841ed66e3e5634","observation_id":"55e0255f-be9e-4d96-8fbc-2cb987a76be0","resolution":{"observed_at":"2026-08-06T22:07:03.471458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:08.250669Z","title":"Improved techniques for optimization-based jailbreaking on large language models,","venue":null,"work_id":"8bd9a5cc-a1bc-4563-87b6-087a4e7b55ca","year":null},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:03.563878Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:1a412cd2d89f2399e65d5820e75ad59948a7427f19a0cf3de29df85cdb43afd3","observation_id":"e4fb46f3-1669-4f5f-91d5-94099fa07580","resolution":{"observed_at":"2026-08-06T22:07:08.322062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-16T15:03:33.817088Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-08-06T22:07:03.747430Z","title":"Open sesame! universal black box jailbreaking of large language models.arXiv preprint arXiv:2309.01446, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:03.747430Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:85012f237b1ae3db5ec58355cd43e1017de8732c66bcd066717921ee9a2c041d","observation_id":"fd629e92-463b-4d93-bd3f-e286209cb7df","resolution":{"observed_at":"2026-08-06T22:07:03.747430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14872","last_updated":"2024-02-27T13:49:22Z","snapshot_observed_at":"2026-08-18T14:36:23.102820Z","submitted_at":"2024-02-21T15:13:50Z","title":"Semantic Mirror Jailbreak: Genetic Algorithm Based Jailbreak Prompts Against Open-source LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14872","snapshot_observed_at":"2026-08-06T22:07:03.831536Z","title":"Semantic mirror jailbreak: Genetic algorithm based jailbreak prompts against open-source llms.arXiv preprint arXiv:2402.14872, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:03.831536Z"},"links":{"cited_paper":"/paper/2402.14872","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:7705de088dfd0702d4be26ae434a502b18397bece8643ad6f4d65356b3406638","observation_id":"57730b1f-8ed8-4967-8021-eb8db081b744","resolution":{"observed_at":"2026-08-06T22:07:03.831536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05295","last_updated":"2025-04-22T05:20:39Z","snapshot_observed_at":"2026-08-20T11:24:30.504823Z","submitted_at":"2024-10-03T17:59:01Z","title":"AutoDAN-Turbo: A Lifelong Agent for Strategy Self-Exploration to Jailbreak LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05295","snapshot_observed_at":"2026-08-06T22:07:03.921548Z","title":"Autodan-turbo: A lifelong agent for strategy self-exploration to jailbreak llms.arXiv preprint arXiv:2410.05295, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:03.921548Z"},"links":{"cited_paper":"/paper/2410.05295","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:ede94cb363933fa9207921a4d5cf14bb70f38b0df0bc7162578c14869437c7ae","observation_id":"e6eff8a6-30ba-4341-9ce7-7aeea4b8911d","resolution":{"observed_at":"2026-08-06T22:07:03.921548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:08.091671Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models","venue":null,"work_id":"153656e4-9ce1-4237-862c-74fa43c70137","year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:04.027676Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:aa161553191967df60cdec0f1ccd0d91a72f01464dd0b09f1d15ce442c3339bc","observation_id":"15316cbc-44b2-454f-9daf-1d072f2ee5c1","resolution":{"observed_at":"2026-08-06T22:07:08.139900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-08-16T09:07:20.265665Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-06T22:07:04.103976Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal.arXiv preprint arXiv:2402.04249, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:04.103976Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:b31507b42e06f62ab227e52f6842f86e5dd6ee95542e4a65ae1174afd76e6f81","observation_id":"50a045eb-dbfe-41dc-83b5-e4bbf0419167","resolution":{"observed_at":"2026-08-06T22:07:04.103976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:04.194194Z","title":"Tree of attacks: Jailbreaking black-box llms automatically, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:04.194194Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:e3862092bfcf939fd0df28437dfee89a6f16a0211939b808dd2b9cc97524a4f5","observation_id":"f19c0e2d-0404-4601-8558-7be78d8b2d22","resolution":{"observed_at":"2026-08-06T22:07:04.194194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11045","last_updated":"2023-11-21T19:43:31Z","snapshot_observed_at":"2026-08-18T09:53:09.812459Z","submitted_at":"2023-11-18T11:44:52Z","title":"Orca 2: Teaching Small Language Models How to Reason","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11045","snapshot_observed_at":"2026-08-06T22:07:04.286535Z","title":"Orca 2: Teaching small language models how to reason.arXiv preprint arXiv:2311.11045, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:04.286535Z"},"links":{"cited_paper":"/paper/2311.11045","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:d04b7c4f204b26190ac0f4824c5e9245b2aea0a38a9f1b6c44635acfee307da2","observation_id":"2f687af6-eeb1-4dad-a268-d6ede408ced9","resolution":{"observed_at":"2026-08-06T22:07:04.286535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T22:07:04.351388Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:04.351388Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:a658b72d20d4196ecae9368374b14842926db96a399d10a27ba7e8a8553a2bcf","observation_id":"71b4c652-4003-4c0f-be54-06cf1d4bcbc2","resolution":{"observed_at":"2026-08-06T22:07:04.351388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:04.439286Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:04.439286Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:5d296eafc9702b6b6f59afc0f0ca3428ebb66a381d6e72ba6df8b4705148fb85","observation_id":"d6ff1a9c-0f26-414b-8c7f-7ce26110fed1","resolution":{"observed_at":"2026-08-06T22:07:04.439286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03286","last_updated":"2022-02-07T15:22:17Z","snapshot_observed_at":"2026-08-15T19:46:54.909325Z","submitted_at":"2022-02-07T15:22:17Z","title":"Red Teaming Language Models with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.03286","snapshot_observed_at":"2026-08-06T22:07:04.509519Z","title":"Red teaming language models with language models.arXiv preprint arXiv:2202.03286, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:04.509519Z"},"links":{"cited_paper":"/paper/2202.03286","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:e76ee7ef1e99fdbaca7be8bfb2efe2cd29c3ea56e115ac1c89116cddc2d43470","observation_id":"dd7df08d-fec2-49b5-a126-9b4891c0bc74","resolution":{"observed_at":"2026-08-06T22:07:04.509519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:07.931674Z","title":"Jailbreaking llms: A comprehensive guide (with examples)","venue":null,"work_id":"84e39c35-6b50-4658-9089-76ba0b811698","year":2025},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:04.577696Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:0ee8233f2f373b90e63a95ee6c237d8a3469fd7e5ee9750efcb84b443159eb7b","observation_id":"68eb7ea0-2c22-4638-a633-ff53fc11e035","resolution":{"observed_at":"2026-08-06T22:07:07.996623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:07.787649Z","title":null,"venue":null,"work_id":"8acb4645-0706-46a1-920a-f6c7dd309d82","year":2025},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:04.654371Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:1922025e6af7b7d2d7cada5ce33b2316084f3e0deaea4294b0e7e7872d8cccfa","observation_id":"8e27eb23-6477-46ff-af2a-cdc75330faf5","resolution":{"observed_at":"2026-08-06T22:07:07.841740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03348","last_updated":"2023-11-24T12:50:31Z","snapshot_observed_at":"2026-08-16T14:45:33.781904Z","submitted_at":"2023-11-06T18:55:18Z","title":"Scalable and Transferable Black-Box Jailbreaks for Language Models via Persona Modulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03348","snapshot_observed_at":"2026-08-06T22:07:04.720473Z","title":"Scalable and transferable black-box jailbreaks for language models via persona modulation.arXiv preprint arXiv:2311.03348, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:04.720473Z"},"links":{"cited_paper":"/paper/2311.03348","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:7a756496fe243f9e484906fd9d59b3f752bb490b12069ce6af0a35ec9bd8e024","observation_id":"5942f2a1-cda5-4fab-8a27-6ec6c3c2b392","resolution":{"observed_at":"2026-08-06T22:07:04.720473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:07.638171Z","title":"do anything now","venue":null,"work_id":"5b5363d1-b037-41fb-8b4f-638395f17334","year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:04.770965Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:eeae2fda116f2246f4af14e84532f26129f4b56f5713a00a43d472b52b524b23","observation_id":"4c3674c9-b893-4b93-be7e-0cea63676176","resolution":{"observed_at":"2026-08-06T22:07:07.695282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:04.822496Z","title":"do anything now","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:04.822496Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:387db6b1e04a4468dbb77607e60579bdd3887f7e6dcba0e01ee9d6022eba1358","observation_id":"7df06ede-3ae4-478e-9406-02e3da061c3c","resolution":{"observed_at":"2026-08-06T22:07:04.822496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.15980","last_updated":"2020-11-07T05:33:35Z","snapshot_observed_at":"2026-08-16T19:09:26.533311Z","submitted_at":"2020-10-29T22:54:00Z","title":"AutoPrompt: Eliciting Knowledge from Language Models with Automatically Generated Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.15980","snapshot_observed_at":"2026-08-06T22:07:04.892028Z","title":"Auto- prompt: Eliciting knowledge from language models with automatically generated prompts","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:04.892028Z"},"links":{"cited_paper":"/paper/2010.15980","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:7ce57487581bc66c09d6a1ab3113cfced5f426559414809fec725b5a6ae7c428","observation_id":"60b02e57-c5a9-4b9f-b230-3e8358415cc2","resolution":{"observed_at":"2026-08-06T22:07:04.892028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:04.940673Z","title":"A strongreject for empty jailbreaks.Advances in Neural Information Processing Systems, 37:125416–125440, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:04.940673Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:2d23c93ed978b9cf287a924128c02c71c0ce70ea3f3f84d64c0baa75df09dd14","observation_id":"ae23309d-a854-43b7-afda-d061c12a5f1d","resolution":{"observed_at":"2026-08-06T22:07:04.940673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-08-20T18:27:04.837880Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T22:07:05.052978Z","title":"Gemini: a family of highly capable multimodal models.arXiv preprint arXiv:2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.052978Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:5cdd3b55b99d615c18816931dc237ac99ad02e6c8fede09ac25ed870e9031088","observation_id":"e208020b-6299-4be2-a713-8930e44d8839","resolution":{"observed_at":"2026-08-06T22:07:05.052978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T22:07:05.118079Z","title":"Llama 2: Open foundation and fine-tuned chat models.arXiv preprint arXiv:2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.118079Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:3a01217b299adbfbce73446b45dfacab827bf2f42c851b373bfe5b1acf73307d","observation_id":"33b604d8-ab7f-4006-919d-6abddfe65d3f","resolution":{"observed_at":"2026-08-06T22:07:05.118079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16944","last_updated":"2023-10-25T19:25:16Z","snapshot_observed_at":"2026-08-18T22:05:54.705341Z","submitted_at":"2023-10-25T19:25:16Z","title":"Zephyr: Direct Distillation of LM Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16944","snapshot_observed_at":"2026-08-06T22:07:05.167574Z","title":"Zephyr: Direct distillation of lm alignment.arXiv preprint arXiv:2310.16944, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.167574Z"},"links":{"cited_paper":"/paper/2310.16944","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:57fcf31df5304c2e59b4750ccfbb9b4ca8dc92a72143dd3532da8e150e4e384a","observation_id":"a21fefe7-81e8-44ce-ab97-11c9a52e5cd9","resolution":{"observed_at":"2026-08-06T22:07:05.167574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:07.499312Z","title":"Universal adversarial triggers for attacking and analyzing NLP","venue":null,"work_id":"507325ef-6ce4-4c3a-ba79-5e43bbddc055","year":2019},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.218586Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:bf1535b332fbc3856de0d08eadc73818197261dc4283420ed0ab0b510552f84a","observation_id":"fe778975-189e-476a-bb14-fed6caf8342c","resolution":{"observed_at":"2026-08-06T22:07:07.558998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.07125","last_updated":"2021-01-03T19:58:55Z","snapshot_observed_at":"2026-08-21T12:22:11.736132Z","submitted_at":"2019-08-20T01:51:40Z","title":"Universal Adversarial Triggers for Attacking and Analyzing NLP","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.07125","snapshot_observed_at":"2026-08-06T22:07:05.264755Z","title":"Universal adversarial triggers for attacking and analyzing nlp.arXiv preprint arXiv:1908.07125, 2019","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.264755Z"},"links":{"cited_paper":"/paper/1908.07125","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:c8c4f634349482011103a53e00e454e0f6ca93bf6203e260f72c1e490ed9f58d","observation_id":"29f60ec0-f4e9-486d-9abe-6d832cf5d7bb","resolution":{"observed_at":"2026-08-06T22:07:05.264755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:07.375479Z","title":"Reinforcement learning- driven LLM agent for automated attacks on LLMs","venue":null,"work_id":"b5251972-baae-4ea3-bb42-e06ecce93c1a","year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.321700Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:0663f772f5575245dab188083174055b413a5ca1675e2283780d455a5fccc816","observation_id":"d9cd779b-630e-43bb-aa27-cbac0ed6e276","resolution":{"observed_at":"2026-08-06T22:07:07.419763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:05.371039Z","title":"Jailbroken: How does llm safety training fail?Advances in Neural Information Processing Systems, 36:80079–80110, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.371039Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:cff4a027482d3b2447253514caf38d5ae879e0f76834fd935f90a62196b1ba0d","observation_id":"788aa16d-065c-4a0e-9193-11e7aae4a8a2","resolution":{"observed_at":"2026-08-06T22:07:05.371039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:05.443644Z","title":"Hard prompts made easy: Gradient-based discrete optimization for prompt tuning and discovery","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.443644Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:e1fcd7a5884491c8e492133df0bfb3e76de62234b9d61c05db929016e7116f02","observation_id":"65a38ec1-340c-4d62-bd76-bf3c5de0213f","resolution":{"observed_at":"2026-08-06T22:07:05.443644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:05.494499Z","title":"Simple statistical gradient-following algorithms for connectionist reinforce- ment learning.Machine learning, 8:229–256, 1992","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.494499Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:aa5281e368becbee686c10b8e0acf524b2030e913a51ec285f1234c555f19130","observation_id":"db21f901-be51-41b8-b760-72b6f19d1d7d","resolution":{"observed_at":"2026-08-06T22:07:05.494499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:07.192692Z","title":"Baichuan 2: Open large-scale language models,","venue":null,"work_id":"072c5dfd-9d93-4b8d-a9b5-34daf2209211","year":null},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.567942Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:953c9cb6edeae136f265cb9fbba37d120c4cd35aa4bdeb43529ecb7fc3141879","observation_id":"6830ba36-aa7d-4970-a9d7-10822267d26f","resolution":{"observed_at":"2026-08-06T22:07:07.242249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:05.677247Z","title":"Gptfuzzer: Red teaming large language models with auto-generated jailbreak prompts, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.677247Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:0d76f61cf8cf1922bc7abf3586c988e97de9de0e763a9d6adf56adfe318a05ff","observation_id":"a5e79d73-da34-4400-b676-f25852bc0d5b","resolution":{"observed_at":"2026-08-06T22:07:05.677247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:07.028046Z","title":"Gpt-4 is too smart to be safe: Stealthy chat with llms via cipher, 2024","venue":null,"work_id":"383df28d-7398-49a6-a226-74f5166cf238","year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.729279Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:f170599624d74eb41e3080a6a234984dce2a6462445d50980c456aefa6f43f62","observation_id":"1adb8fc8-39c2-41c6-bcb8-a25e1522d6aa","resolution":{"observed_at":"2026-08-06T22:07:07.113302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:06.858036Z","title":"How johnny can persuade llms to jailbreak them: Rethinking persuasion to challenge ai safety by humanizing llms","venue":null,"work_id":"49a16e66-6fc6-4923-b339-bc6ff8614859","year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.776030Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:e1acee95418b7892dd39119e939882149c8d3b4027c6b50cc7430bb5b351d83c","observation_id":"bf38eaad-b6f2-4ddb-be19-b202d410b575","resolution":{"observed_at":"2026-08-06T22:07:06.919789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:06.710779Z","title":"Autodan: Interpretable gradient-based adversarial attacks on large language models, 2023","venue":null,"work_id":"d9ed04be-d0d4-4025-9a26-35af79dbe337","year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.815927Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:8c358a87f290fe1b014267c61f4ee987c5db7eb9f910357d6efb4b0a8699cce4","observation_id":"5207b50a-a26a-413a-b9c8-ed83191af9b2","resolution":{"observed_at":"2026-08-06T22:07:06.786861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:05.822304Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.822304Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:cf0a3b6fdfd14a9b11023d0405609c085ad5c32b368e50a3a34930d8042ee937","observation_id":"d807e754-646a-4d45-9d6d-e0c3d733368e","resolution":{"observed_at":"2026-08-06T22:07:05.822304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:06.527331Z","title":"A hacker once used a method to","venue":null,"work_id":"50e86a6e-c566-4c13-8baf-8bcf78a04842","year":2024},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.870634Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:5a82d9b9804e1986849f6733fa4e8aed7630155c123671d04dca4d62da3407d2","observation_id":"70f04c24-2b6c-468c-ba56-035d1cfbed16","resolution":{"observed_at":"2026-08-06T22:07:06.612843Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:07:06.307021Z","title":"Guidelines: • The answer NA means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":"b71315d4-812f-49be-b81e-482f1f2dc768","year":2025},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.950247Z"},"links":{"citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:8300e2efb0f0d494d0b3ac47d0a3eefc9abd108feaa776ca3ae6e178349d8119","observation_id":"10319a60-86fe-404e-b161-f702a74d964a","resolution":{"observed_at":"2026-08-06T22:07:06.442490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21018","last_updated":"2024-06-05T16:35:49Z","snapshot_observed_at":"2026-08-20T06:11:16.431827Z","submitted_at":"2024-05-31T17:07:15Z","title":"Improved Techniques for Optimization-Based Jailbreaking on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21018","snapshot_observed_at":"2026-08-06T22:07:03.636792Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:03.636792Z"},"links":{"cited_paper":"/paper/2405.21018","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:0341fb2ca1e583d10a18db06febadb8c322213f67122aebac2069d192534ffc3","observation_id":"6126766f-69e0-4b9e-9aca-6659cfef3d70","resolution":{"observed_at":"2026-08-06T22:07:03.636792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10305","last_updated":"2025-04-17T08:34:42Z","snapshot_observed_at":"2026-08-14T19:59:05.307983Z","submitted_at":"2023-09-19T04:13:22Z","title":"Baichuan 2: Open Large-scale Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10305","snapshot_observed_at":"2026-08-06T22:07:05.617785Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:05.617785Z"},"links":{"cited_paper":"/paper/2309.10305","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:f00b98b27673dae1c01c0b13604668a3beb393c9cb50201428ea94d6ee34f057","observation_id":"59caa545-1aaa-4f7b-89f4-9fc1b72a9df0","resolution":{"observed_at":"2026-08-06T22:07:05.617785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","latest_version":3,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-14T08:28:56.327756Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 2 inbound Pith citation observations for arXiv:2506.22666."}