{"as_of":"2026-08-08T04:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d51dc912e25c82d2bf1403a118086aa42c3f5b7f52bd88a1aed00163ea684888","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T01:02:31.476445Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T17:49:42.112564Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T17:51:41.877221Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"cited_work":{"arxiv_id":"2506.12274","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.12274","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0a407a0b-cdc5-407d-b2e2-8b26b43f288b","year":2025},"citing_paper":{"arxiv_id":"2509.10546","last_updated":"2026-04-24T18:29:01Z","snapshot_observed_at":"2026-08-02T04:58:06.974646Z","submitted_at":"2025-09-07T22:35:15Z","title":"Learning to Conceal Risk: Controllable Multi-turn Red Teaming for LLMs in the Financial Domain","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-18T17:49:42.112564Z"},"links":{"cited_paper":"/paper/2506.12274","citing_paper":"/paper/2509.10546"},"observation_digest":"sha256:9ad6cb0f4bc7176d8ee5e9312136a795e2e3bd605fd92f210bcc6062324eb177","observation_id":"37cb36f4-60e7-476b-856c-01c913c0bbe7","resolution":{"observed_at":"2026-05-18T17:51:41.879269Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.12274/citation-record","integrity":"/paper/2506.12274/integrity","json":"/paper/2506.12274/citation-record.json","paper":"/paper/2506.12274"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:27.992361Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:27.992361Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:e058d07b8720698b90be5df525620b6ab55522254cbb16bff41cc4e215331dcd","observation_id":"4599e56b-8c40-45b2-b42c-c3dafba462cb","resolution":{"observed_at":"2026-08-07T01:02:27.992361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:28.089322Z","title":"Llama 3 model card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.089322Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:5c630f6fb25c7a0826369ba8c75f129678f633dbd82c7dd78f440c571619379b","observation_id":"b590bac7-7219-4e38-9bad-ab644bc47292","resolution":{"observed_at":"2026-08-07T01:02:28.089322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11969","last_updated":"2025-04-17T18:36:08Z","snapshot_observed_at":"2026-07-06T18:47:21.527912Z","submitted_at":"2024-07-16T17:59:55Z","title":"Does Refusal Training in LLMs Generalize to the Past Tense?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11969","snapshot_observed_at":"2026-08-07T01:02:28.139129Z","title":"Does refusal training in llms generalize to the past tense?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.139129Z"},"links":{"cited_paper":"/paper/2407.11969","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:ee0837af94f84708bfe53e777688844cd7f3b3566bd370df93f592b8244e23d4","observation_id":"fb56c737-8c7e-4b8b-a525-fc7ba42f9a2f","resolution":{"observed_at":"2026-08-07T01:02:28.139129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02151","last_updated":"2025-04-17T18:55:45Z","snapshot_observed_at":"2026-08-08T01:18:53.200448Z","submitted_at":"2024-04-02T17:58:27Z","title":"Jailbreaking Leading Safety-Aligned LLMs with Simple Adaptive Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02151","snapshot_observed_at":"2026-08-07T01:02:28.219255Z","title":"Jailbreaking leading safety-aligned llms with simple adaptive attacks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.219255Z"},"links":{"cited_paper":"/paper/2404.02151","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:78124c377d2316cba44fef064a7390fa8f11b7ad7e49849b29edd7c1606e744e","observation_id":"45f4c9b1-61f6-4c56-ac0e-972d3aa5399b","resolution":{"observed_at":"2026-08-07T01:02:28.219255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T01:02:28.245895Z","title":"Constitutional ai: Harmlessness from ai feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.245895Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:f7ff72cdf7182c1ed1f6ce1925d5974d2b200dde42d4f859e8cb364108278aa2","observation_id":"9955a0d8-e12a-4bdc-96fc-35040173a9e6","resolution":{"observed_at":"2026-08-07T01:02:28.245895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-02T14:59:12.115203Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-07T01:02:28.336517Z","title":"Jailbreakbench: An open robustness benchmark for jailbreaking large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.336517Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:246854cbce40d31a29e1728203baa2c9561adf2bc4d90bf2c75fbf9862b4d7a4","observation_id":"73515443-fb14-4a2c-a2b8-88982c43a6ba","resolution":{"observed_at":"2026-08-07T01:02:28.336517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T01:02:28.376924Z","title":"Pappas, and Eric Wong","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.376924Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:b7375553ccd7549ec64d159059dfde180f6444f4cfdb31e614c16641c8f20633","observation_id":"a2e4e2fe-c1aa-4c48-88da-f4468050bfcd","resolution":{"observed_at":"2026-08-07T01:02:28.376924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-08-08T01:20:38.655253Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-07T01:02:28.442955Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.442955Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:25626c1361c00c6e1c30f5bf831d0b72b1332097c542499e072a2cddafa76783","observation_id":"92da5a23-91f1-46d2-80c5-233ed4293158","resolution":{"observed_at":"2026-08-07T01:02:28.442955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06083","last_updated":"2019-08-17T18:34:11Z","snapshot_observed_at":"2026-08-08T03:38:10.333686Z","submitted_at":"2019-08-17T18:34:11Z","title":"Build it Break it Fix it for Dialogue Safety: Robustness from Adversarial Human Attack","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.06083","snapshot_observed_at":"2026-08-07T01:02:28.494126Z","title":"Build it break it fix it for dialogue safety: Robustness from adversarial human attack, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.494126Z"},"links":{"cited_paper":"/paper/1908.06083","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:3b37336cc07de57e04dad193fc873b27249a065a4e66d8833769b34e0e93e483","observation_id":"574d3678-30ed-4795-905f-b9ba33de1454","resolution":{"observed_at":"2026-08-07T01:02:28.494126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:32.727444Z","title":"Google gemini flash, February 2025","venue":null,"work_id":"7a1e5c14-4147-473e-b3bd-2f80162afbd8","year":2025},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.542208Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:05a8b70f3866443c1fc5c389c5d175852803001a640d1a43c19a3dde30fd93dc","observation_id":"473d0749-0446-4e7d-975c-e4f8cee67e56","resolution":{"observed_at":"2026-08-07T01:02:32.804000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16339","last_updated":"2025-01-08T20:11:59Z","snapshot_observed_at":"2026-08-07T23:13:03.652587Z","submitted_at":"2024-12-20T21:00:11Z","title":"Deliberative Alignment: Reasoning Enables Safer Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16339","snapshot_observed_at":"2026-08-07T01:02:28.553458Z","title":"Deliberative alignment: Reasoning enables safer language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.553458Z"},"links":{"cited_paper":"/paper/2412.16339","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:e32b3b2d78d4827c4e7e22103a8c384772a47d7c3159f52115df2b585e0851bd","observation_id":"a952a564-86e3-4215-84b1-0e5002fc8b9b","resolution":{"observed_at":"2026-08-07T01:02:28.553458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01294","last_updated":"2025-05-10T19:38:13Z","snapshot_observed_at":"2026-07-06T19:25:42.156795Z","submitted_at":"2024-10-02T07:40:56Z","title":"Endless Jailbreaks with Bijection Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01294","snapshot_observed_at":"2026-08-07T01:02:28.608823Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.608823Z"},"links":{"cited_paper":"/paper/2410.01294","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:0d88e3674e1a4d155c6e193260762ac3ca175fe4b72cdcbc540bf6450f50f4ad","observation_id":"883e1bf8-fe66-41cd-a0e0-11ef0faf44fc","resolution":{"observed_at":"2026-08-07T01:02:28.608823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:32.527798Z","title":"Perspective api, 2024","venue":null,"work_id":"b48a416d-7bd1-4aa9-9710-077146f761d6","year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.647062Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:4aff50a351026fde37bbb26743fb5bd6f400479e744e896b8e654c99e18635b0","observation_id":"4a6827c6-57e4-4c4f-b82b-4a02dbd4b8be","resolution":{"observed_at":"2026-08-07T01:02:32.614286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:28.827911Z","title":"Guard: Role-playing to generate natural-language jailbreakings to test guideline adherence of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.827911Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:42325ebde7bc615ace1f322dcdb17af32be98c3e7c19162644b52ac73708db5c","observation_id":"9feef088-88b1-411c-a5e0-edf3e581e8f5","resolution":{"observed_at":"2026-08-07T01:02:28.827911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20413","last_updated":"2024-05-30T18:38:36Z","snapshot_observed_at":"2026-07-06T18:22:57.400982Z","submitted_at":"2024-05-30T18:38:36Z","title":"Jailbreaking Large Language Models Against Moderation Guardrails via Cipher Characters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20413","snapshot_observed_at":"2026-08-07T01:02:28.929877Z","title":"Menke, and Haohan Wang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.929877Z"},"links":{"cited_paper":"/paper/2405.20413","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:95131fcecb9a5d941fba02aac0c7520c3ccb46486e0f78205f774a91a86b5f09","observation_id":"0aaacc26-e9ae-46e3-b432-fb1b3be88750","resolution":{"observed_at":"2026-08-07T01:02:28.929877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04381","last_updated":"2023-03-08T05:09:59Z","snapshot_observed_at":"2026-07-06T15:00:01.455874Z","submitted_at":"2023-03-08T05:09:59Z","title":"Automatically Auditing Large Language Models via Discrete Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04381","snapshot_observed_at":"2026-08-07T01:02:29.019773Z","title":"Automatically auditing large language models via discrete optimization, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.019773Z"},"links":{"cited_paper":"/paper/2303.04381","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:0e5620637df5bb7809071cef7058d707e5062620ab0e2ec1fd4d4101963ce93e","observation_id":"f29a9c8c-1f44-4a57-a31a-e16b4f2438e7","resolution":{"observed_at":"2026-08-07T01:02:29.019773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16914","last_updated":"2024-11-11T23:08:20Z","snapshot_observed_at":"2026-07-06T17:35:45.288097Z","submitted_at":"2024-02-25T17:43:29Z","title":"DrAttack: Prompt Decomposition and Reconstruction Makes Powerful LLM Jailbreakers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16914","snapshot_observed_at":"2026-08-07T01:02:29.162442Z","title":"Drattack: Prompt decomposition and reconstruction makes powerful llm jailbreakers, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.162442Z"},"links":{"cited_paper":"/paper/2402.16914","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:01956619557bb920866af1ca31ab9db9828549fc13448f470a8c35156d33f143","observation_id":"65c9f057-029c-4115-b33d-15030852ea12","resolution":{"observed_at":"2026-08-07T01:02:29.162442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-07T01:02:29.259137Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.259137Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:5804bfdc55b3f083c4f257c206ec99b7b921e84c707e7b6a5f05fc00d89c08ff","observation_id":"4a430d69-8ffb-4eb8-99a2-165fd2e62582","resolution":{"observed_at":"2026-08-07T01:02:29.259137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:32.328732Z","title":"Latent space cartography: Visual analysis of vector space embeddings","venue":null,"work_id":"debdd3be-e550-4a79-9af1-6064a2b1d197","year":2019},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.359293Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:7d454967cb6ea0833ea69770deeb15a200cc8116537d529e063bed57f8dc1173","observation_id":"541aa07d-fcb4-422d-9be6-2c74fe02c0ea","resolution":{"observed_at":"2026-08-07T01:02:32.406428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04237","last_updated":"2023-05-29T17:06:45Z","snapshot_observed_at":"2026-08-07T08:05:23.646592Z","submitted_at":"2023-02-08T18:07:31Z","title":"Black Box Adversarial Prompting for Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04237","snapshot_observed_at":"2026-08-07T01:02:29.510173Z","title":"Black box adversarial prompting for foundation models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.510173Z"},"links":{"cited_paper":"/paper/2302.04237","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:cdbea9204d8cfef2dae388680d5e532654a4962a1d8e927637a77942cb25aaf3","observation_id":"6efa3274-449a-4025-b20e-ff89ea5efc74","resolution":{"observed_at":"2026-08-07T01:02:29.510173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-07T01:02:29.635233Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.635233Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:73b0d4b81a12aa964499886bd746f7d8bd16e988e0d48a12404b335d0d3b427a","observation_id":"a809df2a-ab18-47f9-853a-35b55696cd33","resolution":{"observed_at":"2026-08-07T01:02:29.635233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02119","last_updated":"2024-10-31T15:57:42Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:49:23Z","title":"Tree of Attacks: Jailbreaking Black-Box LLMs Automatically","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02119","snapshot_observed_at":"2026-08-07T01:02:29.718383Z","title":"Tree of attacks: Jailbreaking black-box llms automatically, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.718383Z"},"links":{"cited_paper":"/paper/2312.02119","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:2f8fde340dd7596a143bf8c5e6de176db202964bdeddf61a32894fac322a81d8","observation_id":"24cad203-093f-4e9c-bf12-42058fd26783","resolution":{"observed_at":"2026-08-07T01:02:29.718383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00436","last_updated":"2023-10-05T12:59:59Z","snapshot_observed_at":"2026-08-05T10:40:40.562724Z","submitted_at":"2023-08-01T10:31:36Z","title":"SelfCheck: Using LLMs to Zero-Shot Check Their Own Step-by-Step Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00436","snapshot_observed_at":"2026-08-07T01:02:29.757780Z","title":"Selfcheck: Using llms to zero-shot check their own step-by-step reasoning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.757780Z"},"links":{"cited_paper":"/paper/2308.00436","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:69c448d35a23734063688bd2cfb993f8019149c45536f5127b8ea33737485e8f","observation_id":"10e19b5b-e007-47c4-bf0a-f615dafda644","resolution":{"observed_at":"2026-08-07T01:02:29.757780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:32.172119Z","title":"Openai moderation api, 2024","venue":null,"work_id":"3db39a0e-c830-488a-a06f-b29ba7d6daf9","year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.845731Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:5d05159decb16a9404925babc8f4be7af53815e3df1fabec3ad74922e243cf03","observation_id":"6200ca5a-b30b-4867-b0b9-f8011ce157a4","resolution":{"observed_at":"2026-08-07T01:02:32.219003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T01:02:29.913107Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:29.913107Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:0e8f3229cbe9fbac5525f15e88826ef5888938b16dffac2b4e57be65b74ca0b3","observation_id":"b38239c3-6085-4789-8206-326b6f1e0291","resolution":{"observed_at":"2026-08-07T01:02:29.913107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:30.027097Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.027097Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:8c6169bcaa71401c09046b014d49b709d77d883bc35f4f95cf30651080fc4012","observation_id":"6b8825c2-d16d-4378-bea6-e14046117ef8","resolution":{"observed_at":"2026-08-07T01:02:30.027097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16873","last_updated":"2025-06-02T18:59:01Z","snapshot_observed_at":"2026-08-05T10:26:02.067012Z","submitted_at":"2024-04-21T22:18:13Z","title":"AdvPrompter: Fast Adaptive Adversarial Prompting for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16873","snapshot_observed_at":"2026-08-07T01:02:30.091792Z","title":"Advprompter: Fast adaptive adversarial prompting for llms, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.091792Z"},"links":{"cited_paper":"/paper/2404.16873","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:c93f3c5fe42be264bbcf7365db136476ad9417e23ed3192d1976e1cce62d096a","observation_id":"80fcbd30-de18-44ae-81ce-192f881e457b","resolution":{"observed_at":"2026-08-07T01:02:30.091792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:30.174966Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.174966Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:f725210c4c60e489a0de6bd6ddf238c739764b8223126cff2e34cf90b478752b","observation_id":"b793d7b8-c6d6-4b08-b920-345c2a849c87","resolution":{"observed_at":"2026-08-07T01:02:30.174966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07865","last_updated":"2024-09-14T11:41:49Z","snapshot_observed_at":"2026-08-08T03:05:44.913138Z","submitted_at":"2024-03-12T17:55:38Z","title":"CodeAttack: Revealing Safety Generalization Challenges of Large Language Models via Code Completion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07865","snapshot_observed_at":"2026-08-07T01:02:30.366652Z","title":"Exploring safety generalization challenges of large language models via code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.366652Z"},"links":{"cited_paper":"/paper/2403.07865","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:a0858dddbf144cfa51853a24486b4265d166d4e0c9bd1d00868173c361dade2e","observation_id":"c0c2182a-f26f-4c40-bf7f-b3bcf6a1a0da","resolution":{"observed_at":"2026-08-07T01:02:30.366652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-07T01:02:30.422551Z","title":"Smoothllm: Defending large language models against jailbreaking attacks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.422551Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:0caf8435efdea2cc23834618eb3fcbbc8bcf95e28710d5dc616b38162c3826ed","observation_id":"314bd4fa-9e4f-4c90-8d5a-5b5c89129320","resolution":{"observed_at":"2026-08-07T01:02:30.422551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:30.513966Z","title":"do anything now","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.513966Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:51e10dfa6e06242dee2b0ff01c05aa1151ca96ad6512d583231042c7d5662efa","observation_id":"5ab4b317-26e8-41fe-b82d-e552fd642400","resolution":{"observed_at":"2026-08-07T01:02:30.513966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:30.587700Z","title":"Recursive deep models for semantic compositionality over a sentiment treebank","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.587700Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:918a0435f4893e8fb0224e37091eb27f006a811631b3a4e03af4d7e495522552","observation_id":"7c95f0d9-0902-46fa-9095-085198e0c53e","resolution":{"observed_at":"2026-08-07T01:02:30.587700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:30.712250Z","title":"Large language models in medicine","venue":null,"work_id":null,"year":1930},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.712250Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:1f2504f86740271066b33010431410cd649d4f547be56e33b9d75d13788154fa","observation_id":"dbd642cc-ed8a-4ba2-8d62-f8a6c359e9da","resolution":{"observed_at":"2026-08-07T01:02:30.712250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T01:02:30.756720Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.756720Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:daeb94bfc2447d7b2c6f7a5e7be61ceb58da5fa6a07cf7b0e1e00491ee09883f","observation_id":"fcdfa2ab-2f5c-43c9-ab85-01f48fa5160e","resolution":{"observed_at":"2026-08-07T01:02:30.756720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:30.856232Z","title":"Visualizing data using t-sne","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.856232Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:c01793daecd438336bbd720571a3daf4e0e0ac392fb60ab8d08299b941883dfd","observation_id":"8ab6afcf-d67c-4ad8-a10a-563b24ebe579","resolution":{"observed_at":"2026-08-07T01:02:30.856232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:02:30.934742Z","title":"Jailbroken: How does llm safety training fail? Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:30.934742Z"},"links":{"citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:c0c7dec554fd06eac520aa28d81bbfeeb1772d9699d012be42e9dc61e77d7c24","observation_id":"c709599e-1314-44af-9e8d-3c787a4fce59","resolution":{"observed_at":"2026-08-07T01:02:30.934742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06387","last_updated":"2024-05-25T07:01:15Z","snapshot_observed_at":"2026-08-06T13:25:52.403871Z","submitted_at":"2023-10-10T07:50:29Z","title":"Jailbreak and Guard Aligned Language Models with Only Few In-Context Demonstrations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06387","snapshot_observed_at":"2026-08-07T01:02:31.037588Z","title":"Jailbreak and guard aligned language models with only few in-context demonstrations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:31.037588Z"},"links":{"cited_paper":"/paper/2310.06387","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:a99aa1830050d5c88ee5854ce60df64417ce483b32643ef4ce81a84824bf344a","observation_id":"55f36b96-93fa-4d92-8919-e1cc47c74088","resolution":{"observed_at":"2026-08-07T01:02:31.037588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17564","last_updated":"2023-12-21T06:21:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T17:30:36Z","title":"BloombergGPT: A Large Language Model for Finance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17564","snapshot_observed_at":"2026-08-07T01:02:31.124015Z","title":"Bloomberggpt: A large language model for finance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:31.124015Z"},"links":{"cited_paper":"/paper/2303.17564","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:bb47b27d5d1fade4eb730bcaa7bb3f4675d2190b2e053cbb4f1b246451aa8eee","observation_id":"73cea915-73c7-46c1-b2e3-ef246887c76b","resolution":{"observed_at":"2026-08-07T01:02:31.124015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09827","last_updated":"2024-02-29T08:20:07Z","snapshot_observed_at":"2026-07-06T16:48:33.164024Z","submitted_at":"2023-11-16T11:52:22Z","title":"Cognitive Overload: Jailbreaking Large Language Models with Overloaded Logical Thinking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09827","snapshot_observed_at":"2026-08-07T01:02:31.192664Z","title":"Cognitive overload: Jailbreaking large language models with overloaded logical thinking, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:31.192664Z"},"links":{"cited_paper":"/paper/2311.09827","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:7ca37a02ddd078fe3bd0c03f448e80d6c8ef6323769db3c3301d9ec784eab113","observation_id":"dce94c35-f6d7-4b5d-a23d-c2fc8e2b52e1","resolution":{"observed_at":"2026-08-07T01:02:31.192664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06463","last_updated":"2024-03-26T04:23:12Z","snapshot_observed_at":"2026-07-06T16:05:31.757410Z","submitted_at":"2023-08-12T04:05:57Z","title":"GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06463","snapshot_observed_at":"2026-08-07T01:02:31.303381Z","title":"Gpt-4 is too smart to be safe: Stealthy chat with llms via cipher","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:31.303381Z"},"links":{"cited_paper":"/paper/2308.06463","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:c1c4784142dd4bfaace75bd54b9826742e2b8f28e62c5240de99e530d74e27f3","observation_id":"94e37423-7f20-4f0d-a15e-2c7c1724b829","resolution":{"observed_at":"2026-08-07T01:02:31.303381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06373","last_updated":"2024-01-23T22:46:12Z","snapshot_observed_at":"2026-07-06T17:14:36.670116Z","submitted_at":"2024-01-12T16:13:24Z","title":"How Johnny Can Persuade LLMs to Jailbreak Them: Rethinking Persuasion to Challenge AI Safety by Humanizing LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06373","snapshot_observed_at":"2026-08-07T01:02:31.370445Z","title":"How johnny can persuade llms to jailbreak them: Rethinking persuasion to challenge ai safety by humanizing llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:31.370445Z"},"links":{"cited_paper":"/paper/2401.06373","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:16c9f16ed5ecda5d433ef3b09a64645dc65c3bfdb98b41a2b3be3b349edbc70e","observation_id":"9b10db3e-a698-4987-a2eb-a75b8bdc3bc4","resolution":{"observed_at":"2026-08-07T01:02:31.370445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T01:02:31.476445Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:31.476445Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:2a8a803c537765c098a6b35dd4061576baccfee835887d5589c0b5d1f1fab161","observation_id":"73804334-59f5-4743-8987-c8ad397573d2","resolution":{"observed_at":"2026-08-07T01:02:31.476445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-07T23:13:43.432468Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2506.12274."}