{"as_of":"2026-08-07T12:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:399844dec0dd7a4156856bde9f6384f0bb21eb744a75801b0f7f4a5e0019664c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":24,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:26:13.657815Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":27,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2307.02483","last_updated":"2023-07-05T17:58:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-05T17:58:10Z","title":"Jailbroken: How Does LLM Safety Training Fail?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-14T18:17:42.752997Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2307.02483"},"observation_digest":"sha256:dae65bf1a48dda22a51a4790eebc4cd42addf3d99a08515a7db91eb66a2f61e3","observation_id":"40842c4f-588b-44d0-85a7-b46df7e64d03","resolution":{"observed_at":"2026-05-14T18:17:42.855510Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2308.03825","last_updated":"2024-05-15T12:06:31Z","snapshot_observed_at":"2026-07-06T16:03:34.432602Z","submitted_at":"2023-08-07T16:55:20Z","title":"\"Do Anything Now\": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-17T08:39:28.047394Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2308.03825"},"observation_digest":"sha256:d098c6bf4c4f86dfa97e3c9c9a7f4b87cf9376f3c162208e1872bc245ce95cb7","observation_id":"890a477b-2c06-42aa-b0c7-c603ae315350","resolution":{"observed_at":"2026-05-17T08:39:28.174978Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-13T23:24:39.835347Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2309.00614"},"observation_digest":"sha256:d5167137943273d67924d1dd8f9ceda80290ef465914981543318e1f403941ea","observation_id":"72287e84-52b2-4c64-83c7-763383e4bd24","resolution":{"observed_at":"2026-05-13T23:24:40.023866Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T16:28:03.996446Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2310.04451"},"observation_digest":"sha256:9a9d7342a74d9876dc4f3ec1b5f3faf02fc6d8738624e2023ea78d5a527c2c4e","observation_id":"dec75bb5-f715-4e46-a240-8010246d6287","resolution":{"observed_at":"2026-05-12T16:28:04.062859Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2310.06987","last_updated":"2023-10-10T20:15:54Z","snapshot_observed_at":"2026-07-06T16:30:46.321160Z","submitted_at":"2023-10-10T20:15:54Z","title":"Catastrophic Jailbreak of Open-source LLMs via Exploiting Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T22:00:51.487120Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2310.06987"},"observation_digest":"sha256:0115d5cb9ccc955cbffdfd60e20fbb5472318e0b9fa537866790621985c26165","observation_id":"5ca57504-058d-4863-8fff-5f7e9942d0d9","resolution":{"observed_at":"2026-05-16T22:00:51.556822Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2402.06922","last_updated":"2026-04-21T14:06:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-10T11:07:24Z","title":"Whispers in the Machine: Confidentiality in Agentic Systems","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-24T03:59:03.972043Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2402.06922"},"observation_digest":"sha256:d1613739cda04b41a1dc293eefff0824020f04371c01c3ee9ae4eff16ba8d1a7","observation_id":"8f19794a-fcc9-4122-ac96-88a49465957f","resolution":{"observed_at":"2026-05-24T04:03:53.849912Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2402.10260","last_updated":"2024-08-27T03:32:47Z","snapshot_observed_at":"2026-08-04T21:32:35.483431Z","submitted_at":"2024-02-15T18:58:09Z","title":"A StrongREJECT for Empty Jailbreaks","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T21:28:02.745230Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2402.10260"},"observation_digest":"sha256:31e2a4cfd85f4d28f3cf36aadf87c069e85430aafa311870474957a8f906e88d","observation_id":"a1aa8d47-9e09-4692-b3f3-498a0ada33ba","resolution":{"observed_at":"2026-05-16T21:28:02.825041Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2404.08144","last_updated":"2024-04-17T04:34:39Z","snapshot_observed_at":"2026-08-02T04:29:28.130280Z","submitted_at":"2024-04-11T22:07:19Z","title":"LLM Agents can Autonomously Exploit One-day Vulnerabilities","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T04:18:27.597704Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2404.08144"},"observation_digest":"sha256:618186fbec18c311a31dbfe140688cb11631300ab56a0ae8f009e90660620035","observation_id":"83ea2ea0-dc41-4608-8feb-36b8746ef217","resolution":{"observed_at":"2026-05-18T04:18:27.709259Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-04T23:34:13.332065Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T02:20:44.368219Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2407.04295"},"observation_digest":"sha256:7f5f4a6ca18b3a8058f6c905e42e70be1030e896e921b9fba6fc79878c6765fb","observation_id":"db4aa327-8f7b-4cc0-938c-63201fa0ad10","resolution":{"observed_at":"2026-05-15T02:20:44.691880Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2410.07283","last_updated":"2024-10-09T11:01:29Z","snapshot_observed_at":"2026-08-02T17:12:52.352951Z","submitted_at":"2024-10-09T11:01:29Z","title":"Prompt Infection: LLM-to-LLM Prompt Injection within Multi-Agent Systems","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-15T19:32:19.405615Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2410.07283"},"observation_digest":"sha256:1186a758d40473c7366ffb443c493cbf77858a188e4f57b285e8d28bf7abcd16","observation_id":"d826b6f6-c434-4f2f-9f3c-ebcb4d31cbff","resolution":{"observed_at":"2026-05-15T19:32:19.734280Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2410.15362","last_updated":"2026-05-19T04:19:17Z","snapshot_observed_at":"2026-07-06T19:36:36.994783Z","submitted_at":"2024-10-20T11:27:41Z","title":"Faster-GCG: Efficient Discrete Optimization Jailbreak Attacks against Aligned Large Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-23T19:01:43.922848Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2410.15362"},"observation_digest":"sha256:5ede59a46f0022ec85e6c292a7e588df63def077a44d8d25739520c2175a17cc","observation_id":"87dea015-967a-41c4-b047-429f37b479c2","resolution":{"observed_at":"2026-05-23T19:03:21.401463Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-06T19:26:13.657815Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08020","last_updated":"2025-07-08T03:01:00Z","snapshot_observed_at":"2026-08-06T19:19:20.387278Z","submitted_at":"2025-07-08T03:01:00Z","title":"Circumventing Safety Alignment in Large Language Models Through Embedding Space Toxicity Attenuation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:26:13.657815Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2507.08020"},"observation_digest":"sha256:64fd8e123bcb9cf509cc3fc5f71eeaecd4ef6ac2c899965368fb46d3891e8f32","observation_id":"87c3da8a-2bd1-4af8-98b4-e89550e2d730","resolution":{"observed_at":"2026-08-06T19:26:13.657815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T20:31:41.107700Z","title":"Exploiting programmatic behavior of llms: Dual-use through standard secu- rity attacks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10404","last_updated":"2025-08-14T07:12:44Z","snapshot_observed_at":"2026-08-05T20:31:28.198027Z","submitted_at":"2025-08-14T07:12:44Z","title":"Layer-Wise Perturbations via Sparse Autoencoders for Adversarial Text Generation","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:41.107700Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2508.10404"},"observation_digest":"sha256:8b325590d98cbe373ee599c1f0fe4116621d68063bdfd04d4d6c6b4f23e995ba","observation_id":"503994c0-873c-4d01-bc23-7d6f96f3ef5c","resolution":{"observed_at":"2026-08-05T20:31:41.107700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T14:51:03.693056Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security At- tacks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20848","last_updated":"2025-08-28T14:40:27Z","snapshot_observed_at":"2026-08-05T14:51:02.831302Z","submitted_at":"2025-08-28T14:40:27Z","title":"JADES: A Universal Framework for Jailbreak Assessment via Decompositional Scoring","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T14:51:03.693056Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2508.20848"},"observation_digest":"sha256:bca800c7aa330e80ffd03745c731aff0e4e8e3ab087f36a9a57e266f56b1f614","observation_id":"a6857368-c41a-444e-9b2e-866c399a234a","resolution":{"observed_at":"2026-08-05T14:51:03.693056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T05:59:27.941873Z","title":"Exploiting programmatic behavior of llms: Dual-use through standard security attacks, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04615","last_updated":"2025-09-04T18:59:07Z","snapshot_observed_at":"2026-08-05T05:59:27.514485Z","submitted_at":"2025-09-04T18:59:07Z","title":"Breaking to Build: A Threat Model of Prompt-Based Attacks for Securing LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T05:59:27.941873Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2509.04615"},"observation_digest":"sha256:9f66be5ec4263a334b32c5b57534fd20f44b64e0aa1e861a68bb0cffba82ca69","observation_id":"7f0c4c94-9fea-4cec-b91e-ed6b9cb57b4e","resolution":{"observed_at":"2026-08-05T05:59:27.941873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-04T23:10:21.297410Z","title":"Exploiting programmatic behavior of llms: Dual-use through standard security attacks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06795","last_updated":"2025-09-08T15:24:33Z","snapshot_observed_at":"2026-08-06T11:18:33.345942Z","submitted_at":"2025-09-08T15:24:33Z","title":"Anchoring Refusal Direction: Mitigating Safety Risks in Tuning via Projection Constraint","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T23:10:21.297410Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2509.06795"},"observation_digest":"sha256:847eec5b775f19d808652b6060c3361bcf5972247a88a260d863b4b037fc026c","observation_id":"3540126a-5c94-4b96-a78e-565f1ab7fa6f","resolution":{"observed_at":"2026-08-04T23:10:21.297410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-04T23:09:41.524212Z","title":"Exploiting programmatic behavior of llms: Dual-use through standard security attacks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06807","last_updated":"2025-09-08T15:39:17Z","snapshot_observed_at":"2026-08-06T11:18:26.434722Z","submitted_at":"2025-09-08T15:39:17Z","title":"MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T23:09:41.524212Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2509.06807"},"observation_digest":"sha256:98e0d973bde9221e6ed22ecc31999d1b546cd10acc7b913729902cedeb00e255","observation_id":"efbff674-42ba-4754-b406-ece032bb95c6","resolution":{"observed_at":"2026-08-04T23:09:41.524212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-03T02:51:56.253042Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.09629","last_updated":"2026-02-10T10:17:25Z","snapshot_observed_at":"2026-08-03T06:14:59.333898Z","submitted_at":"2026-02-10T10:17:25Z","title":"Stop Testing Attacks, Start Diagnosing Defenses: The Four-Checkpoint Framework Reveals Where LLM Safety Breaks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T02:51:56.253042Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2602.09629"},"observation_digest":"sha256:320c22bf2b298e6e4f0712e1abcaeb2a63007e601a724593dcbfe99734cfd240","observation_id":"d508c59e-88d6-4476-ab2e-39b72eba5cac","resolution":{"observed_at":"2026-08-03T02:51:56.253042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2604.27001","last_updated":"2026-04-29T03:58:55Z","snapshot_observed_at":"2026-07-06T23:12:33.898150Z","submitted_at":"2026-04-29T03:58:55Z","title":"An Empirical Security Evaluation of LLM-Generated Cryptographic Rust Code","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-07T13:26:17.100399Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2604.27001"},"observation_digest":"sha256:07e04ae44679ec17d4e56d2b7b92a99f74c709b376a345657bc8002283df3a53","observation_id":"1160e7af-8cad-404a-a8de-db28bcebb7d5","resolution":{"observed_at":"2026-05-12T08:56:26.794119Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2605.00348","last_updated":"2026-06-23T05:52:02Z","snapshot_observed_at":"2026-08-02T18:11:47.818278Z","submitted_at":"2026-05-01T02:14:38Z","title":"Block-wise Codeword Embedding for Reliable Multi-bit Text Watermarking","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-09T19:52:21.350072Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2605.00348"},"observation_digest":"sha256:e4af5181d817bf0dbe163093c7d4f3d2592a0cb6f171c1d3774dbb5f2315ff34","observation_id":"ed14cc08-8635-43ca-add9-8f1e6044f166","resolution":{"observed_at":"2026-05-11T15:31:06.043863Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2606.25097","last_updated":"2026-06-23T19:06:42Z","snapshot_observed_at":"2026-08-02T20:00:46.182561Z","submitted_at":"2026-06-23T19:06:42Z","title":"Speculative Decoding at Temperature Zero: A Scoped Safety-Invariance Screen with a 48,072-Sample Expansion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T00:05:06.647295Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2606.25097"},"observation_digest":"sha256:5f2a5e74b750d9687b3335e2d910fb1dd71c769259e82fc49782d0af1607b155","observation_id":"a2877a87-885f-4c60-b65a-24eb260debe9","resolution":{"observed_at":"2026-07-04T16:59:58.296057Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2606.30783","last_updated":"2026-06-29T18:11:17Z","snapshot_observed_at":"2026-07-07T00:04:34.491408Z","submitted_at":"2026-06-29T18:11:17Z","title":"Security--Fidelity Tradeoffs: The Hidden Cost of Prompt Injection Defense","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-07-01T01:44:07.700127Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2606.30783"},"observation_digest":"sha256:e65f49a97145518e9bfbc43b275a7b7db10a82421fbaa42f080dae415bbd898e","observation_id":"a0791066-8569-4077-912c-6a9276d55ff4","resolution":{"observed_at":"2026-07-01T12:45:44.893381Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":"2302.05733","doi":"10.48550/arxiv.2302.05733","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","venue":"arXiv (Cornell University)","work_id":"af526e2c-20e1-45cd-8ff1-63668199c882","year":2023},"citing_paper":{"arxiv_id":"2606.31639","last_updated":"2026-06-30T13:21:43Z","snapshot_observed_at":"2026-08-03T05:59:43.224416Z","submitted_at":"2026-06-30T13:21:43Z","title":"A Lifecycle and Application-Stack Survey of Large Language Model Vulnerabilities: Attacks, Risks, Defenses, and Open Problems","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-01T04:44:23.543728Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2606.31639"},"observation_digest":"sha256:43b441a5c9d72289513eea953c1f9489ca73d964fc05e10c11b896f71f5bb7c2","observation_id":"6b1f1121-dc29-424d-8748-8d7fa42f2719","resolution":{"observed_at":"2026-07-01T11:05:42.347271Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05733","snapshot_observed_at":"2026-08-01T08:37:33.396857Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27373","last_updated":"2026-07-29T18:25:30Z","snapshot_observed_at":"2026-08-07T11:01:51.678794Z","submitted_at":"2026-07-29T18:25:30Z","title":"RoguePrompt: Dual-Layer Encoding for Self-Reconstruction to Circumvent LLM Moderation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T08:37:33.396857Z"},"links":{"cited_paper":"/paper/2302.05733","citing_paper":"/paper/2607.27373"},"observation_digest":"sha256:e210896a987240398bb7dafed31cfe9d0505029d3d6b4101ee2e30d5081dc861","observation_id":"9d2ee81b-6ff7-4404-86db-19c084bdfc09","resolution":{"observed_at":"2026-08-01T08:37:33.396857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2302.05733/citation-record","integrity":"/paper/2302.05733/integrity","json":"/paper/2302.05733/citation-record.json","paper":"/paper/2302.05733"},"outbound":[],"paper":{"arxiv_id":"2302.05733","last_updated":"2023-02-11T15:57:44Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-07-06T14:50:49.200455Z","submitted_at":"2023-02-11T15:57:44Z","title":"Exploiting Programmatic Behavior of LLMs: Dual-Use Through Standard Security Attacks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 24 inbound Pith citation observations for arXiv:2302.05733."}