{"as_of":"2026-08-07T12:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b6a15bcff1b3794404a8a9b9e73b7c0f37c4a4fb741da40135462af09181f45a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:17:26.801585Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":"2410.12855","doi":"10.48550/arxiv.2410.12855","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi-agent enhanced explanation evaluation framework","venue":"arXiv (Cornell University)","work_id":"238002cb-766b-4269-8818-16e96658f7e9","year":2024},"citing_paper":{"arxiv_id":"2505.16120","last_updated":"2026-05-04T12:54:07Z","snapshot_observed_at":"2026-08-02T10:48:03.601811Z","submitted_at":"2025-05-22T01:52:15Z","title":"LLM-Powered AI Agent Systems and Their Applications in Industry","version":2},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-05-22T14:05:54.535411Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2505.16120"},"observation_digest":"sha256:b22dc8cccbf48eaf74a3c1e2f53fad943e62da4855bcb7906a0c5db4430e83af","observation_id":"39a21f67-dc69-4ff4-9ce6-46a0f5608084","resolution":{"observed_at":"2026-05-22T14:06:38.110538Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-07T10:17:26.801585Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi-agent enhanced explanation evaluation framework,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11094","last_updated":"2025-10-30T06:22:33Z","snapshot_observed_at":"2026-08-07T10:11:06.747781Z","submitted_at":"2025-06-06T05:50:50Z","title":"The Scales of Justitia: A Comprehensive Survey on Safety Evaluation of LLMs","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:26.801585Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2506.11094"},"observation_digest":"sha256:5929cc6143ae37b5842210a1a10b4d94e50aea1e1d0eef86d4aa7b71592c0c17","observation_id":"39f87ec4-b572-468a-8ca6-49826f53a9bd","resolution":{"observed_at":"2026-08-07T10:17:26.801585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-07T00:15:01.751718Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14922","last_updated":"2025-06-24T19:55:23Z","snapshot_observed_at":"2026-08-07T04:49:42.432527Z","submitted_at":"2025-06-17T19:08:02Z","title":"FORTRESS: Frontier Risk Evaluation for National Security and Public Safety","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:01.751718Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2506.14922"},"observation_digest":"sha256:30005fb6e88d915c94aecc034dc54b38ceaa828b6341bf9c2dc2538e9b4834c2","observation_id":"6223093a-3c22-47d2-82ef-f45af762f462","resolution":{"observed_at":"2026-08-07T00:15:01.751718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-05T05:33:22.555010Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi-agent enhanced explanation evaluation framework","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05199","last_updated":"2025-09-05T15:58:49Z","snapshot_observed_at":"2026-08-06T12:06:44.241726Z","submitted_at":"2025-09-05T15:58:49Z","title":"Triadic Fusion of Cognitive, Functional, and Causal Dimensions for Explainable LLMs: The TAXAL Framework","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T05:33:22.555010Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2509.05199"},"observation_digest":"sha256:82cbd4e9296c5df53169b6c961b7b57ee82d44ad1735b00931d6c9a45c67d540","observation_id":"ece9b557-aa9d-4cf1-824d-1872b7de1e45","resolution":{"observed_at":"2026-08-05T05:33:22.555010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-04T09:25:47.497380Z","title":"JAILJUDGE: A comprehensive jailbreak judge benchmark with multi-agent enhanced explanation evaluation framework.CoRR, abs/2410.12855, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.15476","last_updated":"2026-07-04T04:20:15Z","snapshot_observed_at":"2026-08-06T02:45:04.316908Z","submitted_at":"2025-10-17T09:38:54Z","title":"SoK: Systematizing LLM Prompt Security: Taxonomies, Datasets, and Unified Evaluation of Attacks and Defenses","version":3},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-08-04T09:25:47.497380Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2510.15476"},"observation_digest":"sha256:1a16f9636dce606778ae205e84585699d83b88e6740605d7c7f9114ed53b24ad","observation_id":"f995386e-5d23-4b4d-9c7d-da58d65381bd","resolution":{"observed_at":"2026-08-04T09:25:47.497380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":"2410.12855","doi":"10.48550/arxiv.2410.12855","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi-agent enhanced explanation evaluation framework","venue":"arXiv (Cornell University)","work_id":"238002cb-766b-4269-8818-16e96658f7e9","year":2024},"citing_paper":{"arxiv_id":"2604.11309","last_updated":"2026-04-13T11:12:30Z","snapshot_observed_at":"2026-07-30T17:13:57.164751Z","submitted_at":"2026-04-13T11:12:30Z","title":"The Salami Slicing Threat: Exploiting Cumulative Risks in LLM Systems","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T16:07:31.602378Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2604.11309"},"observation_digest":"sha256:bd2d2f55f892771f39742862459fdaecfdf28367581903b67dd73335cefdd5d0","observation_id":"044a9cfa-ca14-46a0-b790-4e35ae7fddd3","resolution":{"observed_at":"2026-05-11T09:16:04.079346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":"2410.12855","doi":"10.48550/arxiv.2410.12855","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi-agent enhanced explanation evaluation framework","venue":"arXiv (Cornell University)","work_id":"238002cb-766b-4269-8818-16e96658f7e9","year":2024},"citing_paper":{"arxiv_id":"2604.17301","last_updated":"2026-04-19T07:35:36Z","snapshot_observed_at":"2026-08-07T11:24:06.816581Z","submitted_at":"2026-04-19T07:35:36Z","title":"RoTRAG: Rule of Thumb Reasoning for Conversation Harm Detection with Retrieval-Augmented Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T06:56:24.757369Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2604.17301"},"observation_digest":"sha256:f2e6d5a239c6f9a29a7b25906579cf959329af3e98e83069911ec499de3b5ce5","observation_id":"ec0abbdd-1819-4a77-92cb-0f92abe0cdf2","resolution":{"observed_at":"2026-05-10T06:56:47.206039Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":"2410.12855","doi":"10.48550/arxiv.2410.12855","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi-agent enhanced explanation evaluation framework","venue":"arXiv (Cornell University)","work_id":"238002cb-766b-4269-8818-16e96658f7e9","year":2024},"citing_paper":{"arxiv_id":"2604.24983","last_updated":"2026-04-27T20:39:08Z","snapshot_observed_at":"2026-07-06T23:10:57.164248Z","submitted_at":"2026-04-27T20:39:08Z","title":"Adaptive Prompt Embedding Optimization for LLM Jailbreaking","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T03:28:32.989179Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2604.24983"},"observation_digest":"sha256:ae5ce4a975874cc16faad2ea4c9f7db81bfed1033c2305473813ddbeb44237c3","observation_id":"4af86a28-e59e-4e7c-afa3-03f8cab20f5c","resolution":{"observed_at":"2026-05-11T22:06:14.615189Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":"2410.12855","doi":"10.48550/arxiv.2410.12855","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi-agent enhanced explanation evaluation framework","venue":"arXiv (Cornell University)","work_id":"238002cb-766b-4269-8818-16e96658f7e9","year":2024},"citing_paper":{"arxiv_id":"2605.01034","last_updated":"2026-05-01T18:59:24Z","snapshot_observed_at":"2026-07-06T23:14:20.123289Z","submitted_at":"2026-05-01T18:59:24Z","title":"A Theoretical Game of Attacks via Compositional Skills","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T19:07:13.287966Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2605.01034"},"observation_digest":"sha256:ca89b4e4783744bfe93170e16249e2d8cd1f2a55fa421082ff0016e5e036a65d","observation_id":"a6899ed4-b57a-40e6-9c66-51f356d13c40","resolution":{"observed_at":"2026-05-11T15:51:43.559011Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":"2410.12855","doi":"10.48550/arxiv.2410.12855","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi-agent enhanced explanation evaluation framework","venue":"arXiv (Cornell University)","work_id":"238002cb-766b-4269-8818-16e96658f7e9","year":2024},"citing_paper":{"arxiv_id":"2605.05058","last_updated":"2026-05-06T15:53:17Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T15:53:17Z","title":"SoK: Robustness in Large Language Models against Jailbreak Attacks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-08T16:42:41.137808Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2605.05058"},"observation_digest":"sha256:b85ff9f66be95c689a4757f5acd49cbfb0ead43879161cf2277a0cf3f1ce8764","observation_id":"c275d417-15b6-4620-b06b-d58a7b9fa940","resolution":{"observed_at":"2026-05-11T18:01:08.897517Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":"2410.12855","doi":"10.48550/arxiv.2410.12855","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi-agent enhanced explanation evaluation framework","venue":"arXiv (Cornell University)","work_id":"238002cb-766b-4269-8818-16e96658f7e9","year":2024},"citing_paper":{"arxiv_id":"2605.09225","last_updated":"2026-05-09T23:51:18Z","snapshot_observed_at":"2026-07-06T23:21:21.560069Z","submitted_at":"2026-05-09T23:51:18Z","title":"The Art of the Jailbreak: Formulating Jailbreak Attacks for LLM Security Beyond Binary Scoring","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T02:42:08.565972Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2605.09225"},"observation_digest":"sha256:bb6d690afc9f1c5996d49f2a7c796235baf06827038532d7548a8e0d456a0515","observation_id":"d790ebaa-a486-4fec-a3b9-cac388296db1","resolution":{"observed_at":"2026-05-12T02:46:18.605173Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":"2410.12855","doi":"10.48550/arxiv.2410.12855","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi-agent enhanced explanation evaluation framework","venue":"arXiv (Cornell University)","work_id":"238002cb-766b-4269-8818-16e96658f7e9","year":2024},"citing_paper":{"arxiv_id":"2605.12746","last_updated":"2026-05-12T20:49:30Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T20:49:30Z","title":"CoT-Guard: Small Models for Strong Monitoring","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-14T19:39:16.264272Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2605.12746"},"observation_digest":"sha256:91337ae3bcbe7cab37735129456db32d8095047f383bf29cdb703e2dfb127f22","observation_id":"d1edbe04-c7eb-4098-8df8-d49ba457bb0e","resolution":{"observed_at":"2026-05-14T19:39:23.737664Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":"2410.12855","doi":"10.48550/arxiv.2410.12855","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi-agent enhanced explanation evaluation framework","venue":"arXiv (Cornell University)","work_id":"238002cb-766b-4269-8818-16e96658f7e9","year":2024},"citing_paper":{"arxiv_id":"2606.07335","last_updated":"2026-06-05T14:49:26Z","snapshot_observed_at":"2026-07-06T23:47:00.425715Z","submitted_at":"2026-06-05T14:49:26Z","title":"Defending Jailbreak Attacks on Large Language Models via Manifold Trajectory Kinetics","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T21:55:48.561400Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2606.07335"},"observation_digest":"sha256:513dcaf92e3552bd8ba35250ae9a4a01acb77d2fd4561db0f9561c2a4833c309","observation_id":"f79c2419-5225-4c37-b5d1-a1ce7771b5ec","resolution":{"observed_at":"2026-07-02T17:37:14.917676Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":"2410.12855","doi":"10.48550/arxiv.2410.12855","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi-agent enhanced explanation evaluation framework","venue":"arXiv (Cornell University)","work_id":"238002cb-766b-4269-8818-16e96658f7e9","year":2024},"citing_paper":{"arxiv_id":"2606.25476","last_updated":"2026-07-21T11:09:35Z","snapshot_observed_at":"2026-08-06T23:05:07.064301Z","submitted_at":"2026-06-24T07:00:53Z","title":"A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-25T20:58:53.119386Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2606.25476"},"observation_digest":"sha256:e69671e7b09cf9a84889a9b88ba37150515618a29ce16387a57adb7cca57a865","observation_id":"3d521efe-a601-4b9e-ac31-b727fefb18a3","resolution":{"observed_at":"2026-07-04T19:50:11.060181Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-08-02T10:16:38.410457Z","title":"arXiv preprint arXiv:2410.12855 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.25476","last_updated":"2026-07-21T11:09:35Z","snapshot_observed_at":"2026-08-06T23:05:07.064301Z","submitted_at":"2026-06-24T07:00:53Z","title":"A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T10:16:38.410457Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2606.25476"},"observation_digest":"sha256:8d29add4979e451124738c7d6e18277b8ef0fc68ee774904f37858d54c63995f","observation_id":"5487eb26-535a-4c4c-8155-82866cd22886","resolution":{"observed_at":"2026-08-02T10:16:38.410457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-07-11T22:40:37.839133Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi- agent enhanced explanation evaluation framework,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-07-15T23:17:49.591501Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-11T22:40:37.839133Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:8dc4c3a5268ab7a3ceedb104a76b0b75840e9f18734e2855cc58d96ceaa0cb44","observation_id":"f96759ab-285c-4f88-8130-3c07ec865a93","resolution":{"observed_at":"2026-07-11T22:40:37.839133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12855","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Jailjudge: A comprehensive jailbreak judge benchmark with multi- agent enhanced explanation evaluation framework,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-07-15T23:17:49.591501Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2410.12855","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:52ef50ec68ddd4c205b618259070377fd160cfc3ab3fb73b89f923c84d2b8fa2","observation_id":"92b849b1-c7f8-4bfe-ba88-60e431f2db42","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.12855/citation-record","integrity":"/paper/2410.12855/integrity","json":"/paper/2410.12855/citation-record.json","paper":"/paper/2410.12855"},"outbound":[],"paper":{"arxiv_id":"2410.12855","last_updated":"2024-10-18T02:35:22Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T19:34:46.714277Z","submitted_at":"2024-10-11T14:56:28Z","title":"JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2410.12855."}