{"as_of":"2026-08-07T12:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd28e8e544dec376240f128d86bc5debe468483a3ed8117db293d0735bba91c6","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":25,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:17:26.788943Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T19:36:08.555578Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":"2402.05668","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-07-01T19:36:08.555578Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":"4d9aebf1-9482-486a-aed6-4694ff09ad1d","year":2024},"citing_paper":{"arxiv_id":"2406.11717","last_updated":"2024-10-30T18:57:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T16:36:12Z","title":"Refusal in Language Models Is Mediated by a Single Direction","version":3},"reference_index":126,"source":"arxiv_source","source_observed_at":"2026-05-13T10:47:55.934081Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2406.11717"},"observation_digest":"sha256:e4f65bacb427c06d31ca56e773d9651c5b8629640d492d1bf797f8e34d9602eb","observation_id":"a9b03fa3-e25e-4aab-91d9-3a40921e7934","resolution":{"observed_at":"2026-05-13T10:47:56.068686Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":"2402.05668","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-07-01T19:36:08.555578Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":"4d9aebf1-9482-486a-aed6-4694ff09ad1d","year":2024},"citing_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-04T23:34:13.332065Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T02:20:44.368219Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2407.04295"},"observation_digest":"sha256:7788e239ab0c2a89314d459d9ee77c85d5f761c72202f4c6123c4f3aa9e28199","observation_id":"73c472e5-a747-4521-b49c-e63f8ad69b10","resolution":{"observed_at":"2026-05-15T02:20:44.591202Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":"2402.05668","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-07-01T19:36:08.555578Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":"4d9aebf1-9482-486a-aed6-4694ff09ad1d","year":2024},"citing_paper":{"arxiv_id":"2409.18169","last_updated":"2026-04-23T18:48:49Z","snapshot_observed_at":"2026-07-06T19:22:58.341345Z","submitted_at":"2024-09-26T17:55:22Z","title":"Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey","version":6},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-23T20:58:16.237327Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2409.18169"},"observation_digest":"sha256:ba4babc78b7b8e240379ef5d7127bae9eb99b7408493158a2ffbee6e63d4d03d","observation_id":"4efbf67c-a5e7-4ffe-9e72-3869d0b34bee","resolution":{"observed_at":"2026-05-23T20:58:26.398289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-07T05:40:20.651700Z","title":"Com- prehensive assessment of jailbreak attacks against llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07402","last_updated":"2025-06-09T03:52:43Z","snapshot_observed_at":"2026-08-07T10:07:41.500171Z","submitted_at":"2025-06-09T03:52:43Z","title":"Beyond Jailbreaks: Revealing Stealthier and Broader LLM Security Risks Stemming from Alignment Failures","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:20.651700Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2506.07402"},"observation_digest":"sha256:e9b445a03e03fb065a7f07436ef6c3d14149bbe069bdf9d3322ce3cfca364869","observation_id":"b2eaf344-2622-4f66-b217-4850c0eb5904","resolution":{"observed_at":"2026-08-07T05:40:20.651700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-07T10:17:26.788943Z","title":"Com- prehensive assessment of jailbreak attacks against llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11094","last_updated":"2025-10-30T06:22:33Z","snapshot_observed_at":"2026-08-07T10:11:06.747781Z","submitted_at":"2025-06-06T05:50:50Z","title":"The Scales of Justitia: A Comprehensive Survey on Safety Evaluation of LLMs","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:26.788943Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2506.11094"},"observation_digest":"sha256:f500d7012a82b56ad1eb8fa49b2ca4d958a17c4474ba524aeb545517107ad13a","observation_id":"266333ba-7c41-48f7-85d0-e27a04f77d93","resolution":{"observed_at":"2026-08-07T10:17:26.788943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-07T04:08:39.731690Z","title":"arXiv preprint arXiv:2402.05668 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11521","last_updated":"2025-06-13T07:22:36Z","snapshot_observed_at":"2026-08-07T12:06:46.005829Z","submitted_at":"2025-06-13T07:22:36Z","title":"Investigating Vulnerabilities and Defenses Against Audio-Visual Attacks: A Comprehensive Survey Emphasizing Multimodal Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:08:39.731690Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2506.11521"},"observation_digest":"sha256:b689fcfb500a3990149761c609a9299950b3d96738fec9766c36c4074ef20bb2","observation_id":"f4547e9d-2bed-49f3-a872-041039dcc0f2","resolution":{"observed_at":"2026-08-07T04:08:39.731690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-07T01:02:28.442955Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12274","last_updated":"2025-06-13T23:03:11Z","snapshot_observed_at":"2026-08-07T00:52:06.958006Z","submitted_at":"2025-06-13T23:03:11Z","title":"InfoFlood: Jailbreaking Large Language Models with Information Overload","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T01:02:28.442955Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2506.12274"},"observation_digest":"sha256:6aae19a6f4a6d6a4ba024962cf8e8bee6122ae45cd6312965bbc7de89d937549","observation_id":"92da5a23-91f1-46d2-80c5-233ed4293158","resolution":{"observed_at":"2026-08-07T01:02:28.442955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-06T23:00:19.513275Z","title":"Comprehensive assessment of jailbreak attacks against llms.arXiv preprint arXiv:2402.05668,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20251","last_updated":"2025-06-25T08:52:22Z","snapshot_observed_at":"2026-08-06T22:50:32.688077Z","submitted_at":"2025-06-25T08:52:22Z","title":"Q-resafe: Assessing Safety Risks and Quantization-aware Safety Patching for Quantized Large Language Models","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T23:00:19.513275Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2506.20251"},"observation_digest":"sha256:3892d80db233d61eef2271486b3bce7399c22cfcf836242df967bbd7f1e7125c","observation_id":"53031d22-f6a6-49d8-938f-7cc3cf6f8c47","resolution":{"observed_at":"2026-08-06T23:00:19.513275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-06T22:49:58.020442Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20463","last_updated":"2026-07-19T18:23:26Z","snapshot_observed_at":"2026-08-07T07:27:25.794373Z","submitted_at":"2025-06-25T14:12:18Z","title":"Understanding How University Guidelines Address Privacy and Security Issues of Generative AI in Academic Settings","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:49:58.020442Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2506.20463"},"observation_digest":"sha256:0e2c7cdba887c607aa0f318e3fccd4f7021bce934a9a26a0d03874163d77632f","observation_id":"483123a3-0bfe-4cc5-9c74-2c4268e7b18d","resolution":{"observed_at":"2026-08-06T22:49:58.020442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-06T21:27:34.892626Z","title":"Com- prehensive assessment of jailbreak attacks against llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00239","last_updated":"2025-06-30T20:13:49Z","snapshot_observed_at":"2026-08-06T21:18:19.412178Z","submitted_at":"2025-06-30T20:13:49Z","title":"Linearly Decoding Refused Knowledge in Aligned Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:27:34.892626Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2507.00239"},"observation_digest":"sha256:a80cebfbe16a8a0bb1981fbdaa3d97b5881648e503b15abb522b433c12a1d0d5","observation_id":"01705d48-dbcf-4a46-bc10-2a5b4228527b","resolution":{"observed_at":"2026-08-06T21:27:34.892626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-06T19:18:42.941390Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06043","last_updated":"2025-08-06T05:32:54Z","snapshot_observed_at":"2026-08-06T19:09:56.821409Z","submitted_at":"2025-07-08T14:45:21Z","title":"CAVGAN: Unifying Jailbreak and Defense of LLMs via Generative Adversarial Attacks on their Internal Representations","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T19:18:42.941390Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2507.06043"},"observation_digest":"sha256:7d816580776aa8b40d42f9f734394167484d2945ddcf1237ac09f2f1d7220abf","observation_id":"155f482f-eb0c-4b09-930b-c5236f1f9e56","resolution":{"observed_at":"2026-08-06T19:18:42.941390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-06T18:40:52.130030Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.130030Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:f87240e123d9fcd2e89254bc4d0378a4992bcdd9cd2504ad950e54e221976233","observation_id":"833a0af3-8de8-4956-aa95-189fb01a3a44","resolution":{"observed_at":"2026-08-06T18:40:52.130030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-06T01:02:13.588479Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10010","last_updated":"2025-08-06T02:14:28Z","snapshot_observed_at":"2026-08-06T02:30:09.277985Z","submitted_at":"2025-08-06T02:14:28Z","title":"An Audit and Analysis of LLM-Assisted Health Misinformation Jailbreaks Against LLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T01:02:13.588479Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2508.10010"},"observation_digest":"sha256:3cd3906eeb0604152a0bc504b8cf744e4cfd7722e172dd00679dfc7d4704683a","observation_id":"a1426feb-59eb-4b50-8b38-4e88560801cd","resolution":{"observed_at":"2026-08-06T01:02:13.588479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-05T20:31:45.234154Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10404","last_updated":"2025-08-14T07:12:44Z","snapshot_observed_at":"2026-08-05T20:31:28.198027Z","submitted_at":"2025-08-14T07:12:44Z","title":"Layer-Wise Perturbations via Sparse Autoencoders for Adversarial Text Generation","version":1},"reference_index":135,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:45.234154Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2508.10404"},"observation_digest":"sha256:15d969fd19a2f7f762f40bc90ed42ec02ff4b5390752304d96ce43513576eebd","observation_id":"8d1dba16-b206-4dc7-b45c-769d6d1a2b67","resolution":{"observed_at":"2026-08-05T20:31:45.234154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":"2402.05668","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-07-01T19:36:08.555578Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":"4d9aebf1-9482-486a-aed6-4694ff09ad1d","year":2024},"citing_paper":{"arxiv_id":"2508.11222","last_updated":"2025-12-05T05:36:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-15T05:03:26Z","title":"ORFuzz: Fuzzing the \"Other Side\" of LLM Safety -- Testing Over-Refusal","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T23:27:52.438709Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2508.11222"},"observation_digest":"sha256:2306bcbda39626625b8be75beac282b527c2ca23057223388a3761f23bba4031","observation_id":"3c94b144-c84e-4a7f-92de-00f9a3c5adf4","resolution":{"observed_at":"2026-05-18T23:31:54.568455Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-05T17:14:37.440851Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18306","last_updated":"2025-08-23T02:50:55Z","snapshot_observed_at":"2026-08-06T08:25:50.023305Z","submitted_at":"2025-08-23T02:50:55Z","title":"SALMAN: Stability Analysis of Language Models Through the Maps Between Graph-based Manifolds","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T17:14:37.440851Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2508.18306"},"observation_digest":"sha256:1cb6350be9f1dabc5f52e9ebb1e9d2c2696f557138d3f90842e60b76cdc82aad","observation_id":"b71221d5-a147-49b2-8228-46fa8024f7d3","resolution":{"observed_at":"2026-08-05T17:14:37.440851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-05T14:57:12.791829Z","title":"Comprehensive assessment of jailbreak attacks against llms, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20766","last_updated":"2025-08-28T13:22:33Z","snapshot_observed_at":"2026-08-07T12:38:42.068471Z","submitted_at":"2025-08-28T13:22:33Z","title":"Turning the Spell Around: Lightweight Alignment Amplification via Rank-One Safety Injection","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T14:57:12.791829Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2508.20766"},"observation_digest":"sha256:c69343bafe20f222c2a9f00e9da8bd1144e018564b8ff8b79e05d59570d2c3ca","observation_id":"4cd21b06-c7ea-41e7-b016-ad9b2b1c5695","resolution":{"observed_at":"2026-08-05T14:57:12.791829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-05T14:51:03.645921Z","title":"JailbreakRadar: Comprehen- sive Assessment of Jailbreak Attacks Against LLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20848","last_updated":"2025-08-28T14:40:27Z","snapshot_observed_at":"2026-08-05T14:51:02.831302Z","submitted_at":"2025-08-28T14:40:27Z","title":"JADES: A Universal Framework for Jailbreak Assessment via Decompositional Scoring","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T14:51:03.645921Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2508.20848"},"observation_digest":"sha256:dc705982240e5ca485d7d3c68adc0f8d1370ac5e7e291e776d35b75d283087e5","observation_id":"914ffc20-a3ee-46f8-9239-f750fb86e931","resolution":{"observed_at":"2026-08-05T14:51:03.645921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-04T17:46:15.475308Z","title":"Compre- hensive assessment of jailbreak attacks against LLMs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10682","last_updated":"2025-09-12T20:26:16Z","snapshot_observed_at":"2026-08-04T21:00:53.508626Z","submitted_at":"2025-09-12T20:26:16Z","title":"LLM in the Middle: A Systematic Review of Threats and Mitigations to Real-World LLM-based Systems","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T17:46:15.475308Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2509.10682"},"observation_digest":"sha256:e88b1bdeffa43c0b191d85a687aa89dc2b8252b0a3b95973139b75411e1746fd","observation_id":"e95fd325-7c11-47a5-ae6b-5c7da99a67f0","resolution":{"observed_at":"2026-08-04T17:46:15.475308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-07-15T13:15:31.225992Z","title":"Comprehensive assessment of jailbreak attacks against llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.07457","last_updated":"2026-03-08T04:16:06Z","snapshot_observed_at":"2026-08-02T12:17:59.492712Z","submitted_at":"2026-03-08T04:16:06Z","title":"How Well Do AI Systems Solve AP Physics? A Comparative Evaluation of Large Language Models on Algebra-Based Free Response Questions","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-15T13:15:31.225992Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2603.07457"},"observation_digest":"sha256:dec00a1b5dfe3316380c2c5f2f1eced6861316b625673ef5ff3e50b835ffaa0b","observation_id":"4efc1b01-efce-4b62-be4b-0c1e0775fafb","resolution":{"observed_at":"2026-07-15T13:15:31.225992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":"2402.05668","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-07-01T19:36:08.555578Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":"4d9aebf1-9482-486a-aed6-4694ff09ad1d","year":2024},"citing_paper":{"arxiv_id":"2604.07754","last_updated":"2026-04-09T03:20:29Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T03:20:29Z","title":"The Art of (Mis)alignment: How Fine-Tuning Methods Effectively Misalign and Realign LLMs in Post-Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T18:18:56.476698Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2604.07754"},"observation_digest":"sha256:1aa7c3a0c5cf103aa83a6172bf3375409a4e473e6fbab1de3c886ebe5811f6b3","observation_id":"83b253df-03b6-4e6f-9d82-15dc863af4a2","resolution":{"observed_at":"2026-05-11T00:45:50.609141Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":"2402.05668","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-07-01T19:36:08.555578Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":"4d9aebf1-9482-486a-aed6-4694ff09ad1d","year":2024},"citing_paper":{"arxiv_id":"2605.05058","last_updated":"2026-05-06T15:53:17Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T15:53:17Z","title":"SoK: Robustness in Large Language Models against Jailbreak Attacks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T16:42:41.137808Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2605.05058"},"observation_digest":"sha256:669e97d6a396c421319724822da57bea27e66ed3cc5822a786489d58e11a26da","observation_id":"bb8ba95f-ef39-43f5-b0d1-985a43a95377","resolution":{"observed_at":"2026-05-11T18:01:08.866143Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":"2402.05668","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-07-01T19:36:08.555578Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":"4d9aebf1-9482-486a-aed6-4694ff09ad1d","year":2024},"citing_paper":{"arxiv_id":"2606.00150","last_updated":"2026-05-29T03:31:16Z","snapshot_observed_at":"2026-08-03T01:34:57.941568Z","submitted_at":"2026-05-29T03:31:16Z","title":"Persona Attack: Incremental Memory Injection Jailbreak Attack against Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T22:23:00.894059Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2606.00150"},"observation_digest":"sha256:ceb7c2b8081f5df0b01321fca513c3aa1dd99d50e7fee1302a3a8176b5e1296b","observation_id":"356aab86-984e-425c-80a4-1165029df8ba","resolution":{"observed_at":"2026-07-01T19:36:08.557072Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":"2402.05668","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-07-01T19:36:08.555578Z","title":"Comprehensive assessment of jailbreak attacks against llms","venue":null,"work_id":"4d9aebf1-9482-486a-aed6-4694ff09ad1d","year":2024},"citing_paper":{"arxiv_id":"2606.29623","last_updated":"2026-06-28T21:59:31Z","snapshot_observed_at":"2026-07-07T00:03:36.327050Z","submitted_at":"2026-06-28T21:59:31Z","title":"SCARCE: Scalable Cascade Analysis for Rare-event Characterisation via Embeddings","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T07:03:36.414202Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2606.29623"},"observation_digest":"sha256:9b879b704004f9c6dcfc07a63a42edba1cb159b68b9ebe81fd4528b3920733e5","observation_id":"6453eee7-1ef5-458a-9d47-4ea67e510ce6","resolution":{"observed_at":"2026-06-30T07:04:20.789297Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-02T08:30:02.436170Z","title":"Jailbreakradar: Compre- hensive assessment of jailbreak attacks against llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22671","last_updated":"2026-07-06T17:26:46Z","snapshot_observed_at":"2026-08-06T17:18:06.876668Z","submitted_at":"2026-07-06T17:26:46Z","title":"AIR-BENCH Live: An Evolving Safety Benchmark for Foundation Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T08:30:02.436170Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2607.22671"},"observation_digest":"sha256:50ea472bac0a1d0f27b9b3323ca1dce93309e367c542f0f559c110644328224c","observation_id":"30413506-c871-4d98-ae6d-1776f7b318c1","resolution":{"observed_at":"2026-08-02T08:30:02.436170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.05668/citation-record","integrity":"/paper/2402.05668/integrity","json":"/paper/2402.05668/citation-record.json","paper":"/paper/2402.05668"},"outbound":[],"paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","latest_version":3,"primary_category":"cs.CR","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 25 inbound Pith citation observations for arXiv:2402.05668."}