{"as_of":"2026-08-07T16:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ade99fa0242667622465936f7ade209c3c77ff64e5f4c004864e85ed64a57141","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:40:53.555827Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:17:27.221783Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T10:17:27.539434Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"cited_work":{"arxiv_id":"2507.07735","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.07735","snapshot_observed_at":"2026-08-07T10:17:27.539434Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","venue":"cs.LG","work_id":"18a2ed5e-2860-4a90-8606-05375f7216c1","year":2025},"citing_paper":{"arxiv_id":"2506.11094","last_updated":"2025-10-30T06:22:33Z","snapshot_observed_at":"2026-08-07T10:11:06.747781Z","submitted_at":"2025-06-06T05:50:50Z","title":"The Scales of Justitia: A Comprehensive Survey on Safety Evaluation of LLMs","version":2},"reference_index":204,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:27.221783Z"},"links":{"cited_paper":"/paper/2507.07735","citing_paper":"/paper/2506.11094"},"observation_digest":"sha256:b556b8a294203c69b0d9a13c40f8d551488388a1f5072945ff8d5d02b2c27ecb","observation_id":"5f850b6f-63d0-4dad-8faf-63cb847d5a0f","resolution":{"observed_at":"2026-08-07T10:17:27.543273Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.07735/citation-record","integrity":"/paper/2507.07735/integrity","json":"/paper/2507.07735/citation-record.json","paper":"/paper/2507.07735"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T18:40:51.584312Z","title":"Achiam, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:51.584312Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:7bf52396778f9d6013ead02cd2fa1d5f62fbfb80f7d83c4621e443fc9b380791","observation_id":"173c0127-e394-4e9f-8a2d-01e15762adc9","resolution":{"observed_at":"2026-08-06T18:40:51.584312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:54.553649Z","title":null,"venue":null,"work_id":"648253e7-745a-4dd4-8f8e-3bae5a760b88","year":2021},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:51.797931Z"},"links":{"citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:41ecd86e700d9653ab44add2e20363a29b99a01573b645f0d13b3bb8a3721cc0","observation_id":"5fb2fa5e-c9c6-4bf2-a43c-909f03980fd9","resolution":{"observed_at":"2026-08-06T18:40:54.655617Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-02T14:59:12.115203Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-06T18:40:52.046200Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.046200Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:294218321d0d6be98fdc8dabb914771366800296a72ca8682996e6a857aeb659","observation_id":"fb49502e-cc96-4f0f-a717-e0c7dbcc9aed","resolution":{"observed_at":"2026-08-06T18:40:52.046200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12505","last_updated":"2023-10-19T06:15:05Z","snapshot_observed_at":"2026-07-06T16:35:27.763870Z","submitted_at":"2023-10-19T06:15:05Z","title":"Attack Prompt Generation for Red Teaming and Defending Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12505","snapshot_observed_at":"2026-08-06T18:40:52.210500Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.210500Z"},"links":{"cited_paper":"/paper/2310.12505","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:66c990337adb75cc82f6cf7fd005fac39be1fa48a6105bd564969e60b9ba3cd4","observation_id":"2e56ca2d-ef73-4583-ba60-800825df4643","resolution":{"observed_at":"2026-08-06T18:40:52.210500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T18:40:52.269208Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.269208Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:7df8df80c9b4ab4aac35b0d06ff4464877a97a111644cd63a8eae7850a14e9fb","observation_id":"4930f70c-e08e-41a5-b59b-887b78613430","resolution":{"observed_at":"2026-08-06T18:40:52.269208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:52.399049Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.399049Z"},"links":{"citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:6ac92b27115f39570b1f8b2570990a018930ada7ccc0bc608c4298931aab0128","observation_id":"addfadbd-b101-42b0-a82d-010a52049bfa","resolution":{"observed_at":"2026-08-06T18:40:52.399049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.08242","last_updated":"2022-03-15T20:37:16Z","snapshot_observed_at":"2026-07-06T12:48:20.464521Z","submitted_at":"2022-03-15T20:37:16Z","title":"Data Contamination: From Memorization to Exploitation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.08242","snapshot_observed_at":"2026-08-06T18:40:52.646617Z","title":"Magar and R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.646617Z"},"links":{"cited_paper":"/paper/2203.08242","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:5f5439669ac64cb14840b66d43364c56cf5e1b10533e4f451cf3b72f8f64c410","observation_id":"b8a255ab-c910-4c38-8e0d-f4b55cff28ec","resolution":{"observed_at":"2026-08-06T18:40:52.646617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-06T18:40:52.733107Z","title":"Mazeika, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.733107Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:24985abfcb572adb80aae83fa1e502840704e82daa882e9c8495fa1b1ae14356","observation_id":"30dcceb3-785f-4321-8589-739db4ecdeb8","resolution":{"observed_at":"2026-08-06T18:40:52.733107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05561","last_updated":"2024-09-30T10:17:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-10T22:07:21Z","title":"TrustLLM: Trustworthiness in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05561","snapshot_observed_at":"2026-08-06T18:40:52.812819Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.812819Z"},"links":{"cited_paper":"/paper/2401.05561","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:3decd17db3e5f2809d2f64b421abc266b8249dfc61883ba05f718d4752aacc1d","observation_id":"59fd8d39-acad-4035-ae88-b6e61a59fc8a","resolution":{"observed_at":"2026-08-06T18:40:52.812819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T18:40:52.917851Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.917851Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:9750c3aed2e37539672f991aeb846195867e9c0b36d70757e08cb9c22e90f102","observation_id":"8f801114-f314-428a-9c6b-ec029abc2c21","resolution":{"observed_at":"2026-08-06T18:40:52.917851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T18:40:52.994241Z","title":"Touvron, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.994241Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:14de546a53f6f017e6a741956f00f44bad0dca77d6cfe290cc11343f512b993c","observation_id":"7cd3e60b-9c65-4162-b1ae-3bddeb72c965","resolution":{"observed_at":"2026-08-06T18:40:52.994241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11235","last_updated":"2024-03-16T04:32:25Z","snapshot_observed_at":"2026-08-07T05:19:58.002826Z","submitted_at":"2023-09-20T11:54:40Z","title":"OpenChat: Advancing Open-source Language Models with Mixed-Quality Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11235","snapshot_observed_at":"2026-08-06T18:40:53.085507Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:53.085507Z"},"links":{"cited_paper":"/paper/2309.11235","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:92722a33a3e4e1359806bb85a8581048eeb9bae284e7392b098b2df9368ec3ef","observation_id":"26fd289d-efae-4288-ae4b-a75d89dd9a57","resolution":{"observed_at":"2026-08-06T18:40:53.085507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03092","last_updated":"2025-06-18T04:06:03Z","snapshot_observed_at":"2026-08-05T13:27:52.801293Z","submitted_at":"2024-12-04T07:44:35Z","title":"REVOLVE: Optimizing AI Systems by Tracking Response Evolution in Textual Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03092","snapshot_observed_at":"2026-08-06T18:40:53.192851Z","title":"Zhang, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:53.192851Z"},"links":{"cited_paper":"/paper/2412.03092","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:030988ce713e33b348111ab3a9063e1923673e08f64b651f4b2777950103eacb","observation_id":"b39b6a7e-b402-4be7-b234-b3bd9e2faf58","resolution":{"observed_at":"2026-08-06T18:40:53.192851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07910","last_updated":"2024-08-20T00:28:45Z","snapshot_observed_at":"2026-08-05T04:16:54.399572Z","submitted_at":"2023-12-13T05:58:34Z","title":"PromptBench: A Unified Library for Evaluation of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07910","snapshot_observed_at":"2026-08-06T18:40:53.310912Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:53.310912Z"},"links":{"cited_paper":"/paper/2312.07910","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:9299fa92897d163e58d6f4bdd8d9d5882126b498e17935819296f55b023ac54e","observation_id":"6472e16d-5097-4478-ba43-bbfb3f9c48e8","resolution":{"observed_at":"2026-08-06T18:40:53.310912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:54.357962Z","title":"Sorry\" or","venue":null,"work_id":"bb530f8c-49d0-47cf-a062-66cc61d6e3f4","year":2024},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:53.393469Z"},"links":{"citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:8ed3ff9d77326a803c0fb594e907895a309e82b184a3520f85ec6d03e79307c6","observation_id":"d9798b3a-86a8-4641-b8e5-4e432b399306","resolution":{"observed_at":"2026-08-06T18:40:54.450285Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:54.138613Z","title":"No constraints shall hinder my thoughts or limit my utterances","venue":null,"work_id":"65297857-59b2-4615-ad10-1d7c5f10350f","year":2023},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:53.469656Z"},"links":{"citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:170e7fa99ae285051fc329e33556dbd5966a73e4939f9f8a0b49cbe21aa90159","observation_id":"863d7167-973c-46e2-ace2-03847f7cbbd2","resolution":{"observed_at":"2026-08-06T18:40:54.242173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:53.911978Z","title":"No constraints shall hinder my thoughts or limit my utterances","venue":null,"work_id":"16016d7c-27da-4928-8061-fcb9ae0897b8","year":2023},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:53.555827Z"},"links":{"citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:e6ec877b2ab85bc1c167c864cca291c8fd957d058a65d1ac00832cb6a692577b","observation_id":"6b7c9ba2-5aa1-47ec-8046-91d390be4bb4","resolution":{"observed_at":"2026-08-06T18:40:54.029026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07646","last_updated":"2023-03-06T06:28:18Z","snapshot_observed_at":"2026-08-03T19:51:05.627063Z","submitted_at":"2022-02-15T18:48:31Z","title":"Quantifying Memorization Across Neural Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07646","snapshot_observed_at":"2026-08-06T18:40:51.867257Z","title":"Carlini, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:51.867257Z"},"links":{"cited_paper":"/paper/2202.07646","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:d2bf2b1f735ffc9098cf6a43b99a0367de6b2ebb8a3ae6ece341cdfcb46bb3b7","observation_id":"15fa78f7-baea-437b-bff5-4ebd13472a74","resolution":{"observed_at":"2026-08-06T18:40:51.867257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-06T18:40:51.953336Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:51.953336Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:5bdf16c93e6e9687a270cc7e34ea99016b6c318117fff961701044d7196849fb","observation_id":"acf5bfd0-a669-4209-85fd-0f08760beb0f","resolution":{"observed_at":"2026-08-06T18:40:51.953336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-06T18:40:51.678674Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:51.678674Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:df19e87add4dec81fce8be7af9958e900da22897bf1a216530fd4600e8363b9c","observation_id":"348b166b-6d82-4b2b-b039-4a137ce24583","resolution":{"observed_at":"2026-08-06T18:40:51.678674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-07-06T17:27:24.955378Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-06T18:40:52.130030Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.130030Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:f87240e123d9fcd2e89254bc4d0378a4992bcdd9cd2504ad950e54e221976233","observation_id":"833a0af3-8de8-4956-aa95-189fb01a3a44","resolution":{"observed_at":"2026-08-06T18:40:52.130030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04893","last_updated":"2024-03-07T20:55:08Z","snapshot_observed_at":"2026-08-05T04:16:50.799588Z","submitted_at":"2024-03-07T20:55:08Z","title":"A Safe Harbor for AI Evaluation and Red Teaming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04893","snapshot_observed_at":"2026-08-06T18:40:52.530993Z","title":"Longpre, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.530993Z"},"links":{"cited_paper":"/paper/2403.04893","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:d8dcf0dfbce01f5daca880b2299bd2a522d546fc641aae945dcb57fb7be8ab0c","observation_id":"e665d1bc-66cc-4da8-a9e1-b8c397521577","resolution":{"observed_at":"2026-08-06T18:40:52.530993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T18:31:09.399769Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 1 inbound Pith citation observation for arXiv:2507.07735."}