{"as_of":"2026-08-07T14:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5a570971a88b7b7d30f66365f188e492eb1ca841362afd7e2e04b9cc75af9114","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:47:06.503637Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T19:36:08.540565Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.13457","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-07-01T19:36:08.540565Z","title":"A comprehensive study of jailbreak attack versus defense for large language models","venue":null,"work_id":"0b1acec4-924f-45bd-8196-7362449f10cc","year":2024},"citing_paper":{"arxiv_id":"2406.11717","last_updated":"2024-10-30T18:57:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T16:36:12Z","title":"Refusal in Language Models Is Mediated by a Single Direction","version":3},"reference_index":201,"source":"arxiv_source","source_observed_at":"2026-05-13T10:47:55.934081Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2406.11717"},"observation_digest":"sha256:513db32469397b714932bab7d606d77a47a98bc4124ec66a85e0391940ff35cc","observation_id":"96816ab0-ea0e-4e03-b2d8-bd1b244f6442","resolution":{"observed_at":"2026-05-13T10:47:56.160539Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-07T05:47:06.503637Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-07T05:39:20.659933Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.503637Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:73d0a2d75ed0117ff684d5de306a07f75a66adc33060bb9a316227fd7cb46c01","observation_id":"4ec1c18d-206d-45a6-ad1b-233c7e70c5d4","resolution":{"observed_at":"2026-08-07T05:47:06.503637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-06T14:45:42.912963Z","title":"A comprehensive study of jailbreak attack versus defense for large language models.arXiv preprint arXiv:2402.13457,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18105","last_updated":"2025-07-24T05:30:54Z","snapshot_observed_at":"2026-08-06T14:36:17.225757Z","submitted_at":"2025-07-24T05:30:54Z","title":"Understanding the Supply Chain and Risks of Large Language Model Applications","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:42.912963Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2507.18105"},"observation_digest":"sha256:04da23f6f53bb73789535429be76117abc6552143df9a6eafae71332bd75885a","observation_id":"c3576dbb-ce6f-4b77-ad91-e23a35fc89f5","resolution":{"observed_at":"2026-08-06T14:45:42.912963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-05T22:24:23.361494Z","title":"A comprehensive study of jail- break attack versus defense for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07139","last_updated":"2025-08-10T01:59:07Z","snapshot_observed_at":"2026-08-06T02:11:07.077923Z","submitted_at":"2025-08-10T01:59:07Z","title":"A Real-Time, Self-Tuning Moderator Framework for Adversarial Prompt Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T22:24:23.361494Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2508.07139"},"observation_digest":"sha256:7c57a091bc91f9745eff806a63163deb95194d920abc424edeacf01da26a4984","observation_id":"25f5f323-7136-4f16-b93b-e827df8a1a61","resolution":{"observed_at":"2026-08-05T22:24:23.361494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-05T20:31:45.398903Z","title":"A comprehensive study of jailbreak attack versus defense for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10404","last_updated":"2025-08-14T07:12:44Z","snapshot_observed_at":"2026-08-05T20:31:28.198027Z","submitted_at":"2025-08-14T07:12:44Z","title":"Layer-Wise Perturbations via Sparse Autoencoders for Adversarial Text Generation","version":1},"reference_index":137,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:45.398903Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2508.10404"},"observation_digest":"sha256:1fe5e71cf50189680462c7f9e9da0fb9215eb210ffabd7d2398fc8bb937facef","observation_id":"9c20c9f8-8f70-4da7-a200-a906231ac9c9","resolution":{"observed_at":"2026-08-05T20:31:45.398903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.13457","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-07-01T19:36:08.540565Z","title":"A comprehensive study of jailbreak attack versus defense for large language models","venue":null,"work_id":"0b1acec4-924f-45bd-8196-7362449f10cc","year":2024},"citing_paper":{"arxiv_id":"2508.11222","last_updated":"2025-12-05T05:36:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-15T05:03:26Z","title":"ORFuzz: Fuzzing the \"Other Side\" of LLM Safety -- Testing Over-Refusal","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T23:27:52.438709Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2508.11222"},"observation_digest":"sha256:3ea03a3054ec2c94064683eb4194f7476c4b1afcb612288b30f63c6e02c64a1d","observation_id":"5f48ed78-a3b3-4fbc-8a64-39d31cbf9d26","resolution":{"observed_at":"2026-05-18T23:31:54.591943Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-04T23:09:41.435223Z","title":"Llm jailbreak at- tack versus defense techniques–a comprehensive study,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06807","last_updated":"2025-09-08T15:39:17Z","snapshot_observed_at":"2026-08-06T11:18:26.434722Z","submitted_at":"2025-09-08T15:39:17Z","title":"MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T23:09:41.435223Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2509.06807"},"observation_digest":"sha256:fd60f268891c8f87d589c59a554417e51095b6a4e8902b3d03d893eaab5e2f7f","observation_id":"ead34801-dcd9-434d-b7cf-10580f06e3e0","resolution":{"observed_at":"2026-08-04T23:09:41.435223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-04T22:33:28.168620Z","title":"A comprehensive study of jailbreak attack versus defense for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-06T22:54:10.353309Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.168620Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:ef579e708da7173649fa122e9d881765bd6a5b768b3a0c26a269b9eb3224e88c","observation_id":"aa9e6cc6-b697-400f-9c2e-fd2873f19520","resolution":{"observed_at":"2026-08-04T22:33:28.168620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.13457","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-07-01T19:36:08.540565Z","title":"A comprehensive study of jailbreak attack versus defense for large language models","venue":null,"work_id":"0b1acec4-924f-45bd-8196-7362449f10cc","year":2024},"citing_paper":{"arxiv_id":"2604.09747","last_updated":"2026-04-10T07:22:11Z","snapshot_observed_at":"2026-07-06T22:58:34.504325Z","submitted_at":"2026-04-10T07:22:11Z","title":"ADAM: A Systematic Data Extraction Attack on Agent Memory via Adaptive Querying","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T17:57:59.918483Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2604.09747"},"observation_digest":"sha256:844a7cc96f7401cea1639c549fe5882b4456c92913694bde6c4f40d9c7eea638","observation_id":"f8a6ee22-da7a-4884-9f88-a3c118714fda","resolution":{"observed_at":"2026-05-11T05:45:57.609447Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.13457","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-07-01T19:36:08.540565Z","title":"A comprehensive study of jailbreak attack versus defense for large language models","venue":null,"work_id":"0b1acec4-924f-45bd-8196-7362449f10cc","year":2024},"citing_paper":{"arxiv_id":"2604.11309","last_updated":"2026-04-13T11:12:30Z","snapshot_observed_at":"2026-07-30T17:13:57.164751Z","submitted_at":"2026-04-13T11:12:30Z","title":"The Salami Slicing Threat: Exploiting Cumulative Risks in LLM Systems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T16:07:31.602378Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2604.11309"},"observation_digest":"sha256:3ed590a7cb67f204dad909849eabc72bea679cf525a092909f649b6a61e41712","observation_id":"ca2742c6-95f2-45f1-8ee9-319bba9a33bb","resolution":{"observed_at":"2026-05-11T09:16:04.374380Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.13457","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-07-01T19:36:08.540565Z","title":"A comprehensive study of jailbreak attack versus defense for large language models","venue":null,"work_id":"0b1acec4-924f-45bd-8196-7362449f10cc","year":2024},"citing_paper":{"arxiv_id":"2606.00150","last_updated":"2026-05-29T03:31:16Z","snapshot_observed_at":"2026-08-03T01:34:57.941568Z","submitted_at":"2026-05-29T03:31:16Z","title":"Persona Attack: Incremental Memory Injection Jailbreak Attack against Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T22:23:00.894059Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2606.00150"},"observation_digest":"sha256:9b53e8c1acccad899691c6b5278f81b765ff85e6d2c244f827663f0b0ad70773","observation_id":"e46e7c62-8614-458f-9e27-838cb4dc1f6d","resolution":{"observed_at":"2026-07-01T19:36:08.542160Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2402.13457/citation-record","integrity":"/paper/2402.13457/integrity","json":"/paper/2402.13457/citation-record.json","paper":"/paper/2402.13457"},"outbound":[],"paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2402.13457."}