{"as_of":"2026-08-08T01:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:10e281c36a13b6fd2b56ea743e1bc6388cf4cef5a3341921d172639f0d15b84f","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:01:11.473485Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T16:21:26.984437Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T04:16:34.709256Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.00782","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-02T04:16:34.709256Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning.CoRR, abs/2506.00782","venue":null,"work_id":"e1b826c4-b88f-470c-9a0b-efe2984efb7e","year":2025},"citing_paper":{"arxiv_id":"2605.00553","last_updated":"2026-06-30T04:24:39Z","snapshot_observed_at":"2026-07-06T23:13:57.367556Z","submitted_at":"2026-05-01T10:42:08Z","title":"Stable-GFlowNet: Toward Diverse and Robust LLM Red-Teaming via Contrastive Trajectory Balance","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-09T19:29:36.348680Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2605.00553"},"observation_digest":"sha256:23a11f291ff03092735e12a3a2c851f832aec4385bd59c194522f6b3b110e3d6","observation_id":"3caa8e0b-18b1-4a1e-a875-266a80aa3761","resolution":{"observed_at":"2026-05-11T15:41:16.865385Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.00782","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-02T04:16:34.709256Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning.CoRR, abs/2506.00782","venue":null,"work_id":"e1b826c4-b88f-470c-9a0b-efe2984efb7e","year":2025},"citing_paper":{"arxiv_id":"2605.08930","last_updated":"2026-05-09T13:05:00Z","snapshot_observed_at":"2026-07-06T23:21:06.773761Z","submitted_at":"2026-05-09T13:05:00Z","title":"Internalizing Safety Understanding in Large Reasoning Models via Verification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T01:50:59.283409Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2605.08930"},"observation_digest":"sha256:26f35252f4797c7093a237325ec58cbb325a5b85f3640423e6ce9afda5897e95","observation_id":"4426f7f5-4c93-4191-8186-f553eb93f59c","resolution":{"observed_at":"2026-05-12T01:51:14.269926Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.00782","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-02T04:16:34.709256Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning.CoRR, abs/2506.00782","venue":null,"work_id":"e1b826c4-b88f-470c-9a0b-efe2984efb7e","year":2025},"citing_paper":{"arxiv_id":"2605.08936","last_updated":"2026-05-09T13:14:31Z","snapshot_observed_at":"2026-07-06T23:21:06.773761Z","submitted_at":"2026-05-09T13:14:31Z","title":"Self-ReSET: Learning to Self-Recover from Unsafe Reasoning Trajectories","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T02:07:04.364417Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2605.08936"},"observation_digest":"sha256:b721500833edcb17492791c55e5f44372a475839c1664afe1a92f075304fed49","observation_id":"4645865c-d491-420f-917f-eb479a6b126e","resolution":{"observed_at":"2026-05-12T02:11:16.194279Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.00782","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-02T04:16:34.709256Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning.CoRR, abs/2506.00782","venue":null,"work_id":"e1b826c4-b88f-470c-9a0b-efe2984efb7e","year":2025},"citing_paper":{"arxiv_id":"2606.03647","last_updated":"2026-06-02T13:39:15Z","snapshot_observed_at":"2026-07-06T23:43:50.943530Z","submitted_at":"2026-06-02T13:39:15Z","title":"Black-box, Adaptive, Efficient, Transferable, Harmful, Applicable... Attacks Are All You Need to Break LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T09:21:57.373862Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2606.03647"},"observation_digest":"sha256:c305c97e69646b47d087f60b7ec6834035b5d459d80622f6e8ac224e548fdf5b","observation_id":"a31831b8-9265-4c4e-9e19-3609eaaf51d2","resolution":{"observed_at":"2026-07-02T04:16:34.711696Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-11T22:40:37.839133Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-07-15T23:17:49.591501Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-11T22:40:37.839133Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:a471ee478db559f46cd1b936bb692354b236c664fac6eab42de55baa025c2088","observation_id":"e777a612-105b-4bf5-bd5a-b1cd2db8b8f5","resolution":{"observed_at":"2026-07-11T22:40:37.839133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-07-15T23:17:49.591501Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:bed60da66afa5dcd4f8e2d899655c64a57094fcb67294537d40973688c485727","observation_id":"0b78426c-7ced-42f2-b964-4f713e454373","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-14T07:16:57.009797Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning.arXiv preprint arXiv:2506.00782, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11070","last_updated":"2026-07-13T04:19:37Z","snapshot_observed_at":"2026-08-07T05:32:49.065984Z","submitted_at":"2026-07-13T04:19:37Z","title":"MJ: Multi-turn LLM Jailbreaking via Decomposed Credit Assignment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T07:16:57.009797Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2607.11070"},"observation_digest":"sha256:7a9d61a5b64aab6d327844f069daed738809b49bafc5fac490aa37e44dec20e8","observation_id":"f8ab7de0-ef03-447a-9f60-7378374f6c54","resolution":{"observed_at":"2026-07-14T07:16:57.009797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-08-01T16:21:26.984437Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18056","last_updated":"2026-08-06T06:39:11Z","snapshot_observed_at":"2026-08-08T00:14:52.223217Z","submitted_at":"2026-07-20T15:26:23Z","title":"An Early Warning of Emerging Biosecurity Risks in Frontier LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T16:21:26.984437Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2607.18056"},"observation_digest":"sha256:647d745692b677175e114e591bb97526926800bc171a15aad96bb016b762d676","observation_id":"6b3f8d1d-b25c-4b2c-a058-d53d4c66aeff","resolution":{"observed_at":"2026-08-01T16:21:26.984437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00782/citation-record","integrity":"/paper/2506.00782/integrity","json":"/paper/2506.00782/citation-record.json","paper":"/paper/2506.00782"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.845946Z","title":"Claude-3.5-sonnet, 2024","venue":null,"work_id":"b1d13a56-b334-4c92-b3c2-21407b4b91dd","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.174595Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:c9bea15aa6dea9ee1e2731cb2cb0793c917a81c4f62292ae75e19ed6ab95540e","observation_id":"9a1e72f4-36bd-4f13-ba4c-6fb71b2c8699","resolution":{"observed_at":"2026-08-07T12:01:15.888902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18693","last_updated":"2024-12-24T22:38:46Z","snapshot_observed_at":"2026-07-06T20:12:59.152345Z","submitted_at":"2024-12-24T22:38:46Z","title":"Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18693","snapshot_observed_at":"2026-08-07T12:01:08.215841Z","title":"Beutel, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.215841Z"},"links":{"cited_paper":"/paper/2412.18693","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:57f04d09a04bfabc06c959cece57cae431415061a9aac92a37faf0bc0516c0b3","observation_id":"a57cad7f-0a66-442d-ba67-07d698debdec","resolution":{"observed_at":"2026-08-07T12:01:08.215841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.738424Z","title":"Bhardwaj, D","venue":null,"work_id":"ec67667d-1de1-4e82-8870-cdbcb06a12fa","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.265880Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:b8cd41167cefe713a893f8f6d13a0ff4785d4a85ce8709ec7b8d593b4f2b7418","observation_id":"0c83958e-51f1-4715-841a-38e611cdb273","resolution":{"observed_at":"2026-08-07T12:01:15.779030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-07T12:01:08.323501Z","title":"Bommasani, D","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.323501Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:c4a00ec8caffd912006c9dfcd48950bd003546da9c1ea6124fdc6f4015eb7946","observation_id":"bd7a3d64-e8c8-44d7-8978-302a0a69abae","resolution":{"observed_at":"2026-08-07T12:01:08.323501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T12:01:08.370972Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.370972Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:cf8086f7447d34e3e0bb1570aa858431b391f8894b6717564dbec32ac31f0d96","observation_id":"f393ed59-e8d9-45e9-8660-c820a41aa1e5","resolution":{"observed_at":"2026-08-07T12:01:08.370972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.609580Z","title":"Chiang, L","venue":null,"work_id":"5d5f1a97-491d-4da1-a49b-751d865174ed","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.431421Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:20d40153283529101e61cbab4db75e32940eb461f4e5bc6ba4333e6357f3555f","observation_id":"b364c890-f672-4494-8c4e-0c3ca41f3b99","resolution":{"observed_at":"2026-08-07T12:01:15.678396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.489379Z","title":null,"venue":null,"work_id":"9c2f42a3-1418-440b-b439-4d8a7478abee","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.467412Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:d8bdb4aa729027a27a853560eef8d2e764106ab2d1b390de5839e4a6df04ba3f","observation_id":"3a3d76af-8b39-4115-a880-59665351a6f2","resolution":{"observed_at":"2026-08-07T12:01:15.529872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:01:08.506447Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.506447Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:bd5ebd9f015354a40f7700291cf2b9a4369750ebdb4c8944c1bdc9211d4ff22e","observation_id":"673ba450-cba6-4eeb-b443-628662efb98e","resolution":{"observed_at":"2026-08-07T12:01:08.506447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:01:08.542610Z","title":"Grattafiori, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.542610Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:eda3ee810569b79f618078b126acb6de35ed713b2f4349df842f1af0f723f53c","observation_id":"c18d2fbe-eeb3-4382-a8db-52aef4f2b1d5","resolution":{"observed_at":"2026-08-07T12:01:08.542610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.393259Z","title":null,"venue":null,"work_id":"f83f505c-fc1b-4106-a339-1780eca1330a","year":null},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.618088Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:c11203e8dc50f4df06f655531146793b5acfa14afc1ca6dbd108e570eec6b915","observation_id":"d985b050-1d04-41e4-95bc-c5fb7d70cc38","resolution":{"observed_at":"2026-08-07T12:01:15.437821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.276357Z","title":null,"venue":null,"work_id":"c8872d2f-99a6-4a57-acc0-5a93b1985040","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.659593Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:851065ec35fbef0726f9c9892de4f13f98d3692f98526c32457caca36af3449e","observation_id":"072fc78b-14de-47d8-9eb1-8f1452568d74","resolution":{"observed_at":"2026-08-07T12:01:15.329250Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03556","last_updated":"2024-12-19T22:37:45Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-12-04T18:51:32Z","title":"Best-of-N Jailbreaking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03556","snapshot_observed_at":"2026-08-07T12:01:08.712974Z","title":"Hughes, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.712974Z"},"links":{"cited_paper":"/paper/2412.03556","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:43f18ff776a797a13c933de7793b14895aeb5ff677d98498d5dd4a878d2d010d","observation_id":"ca9c6f7a-6ddd-4ef9-9e2c-e833b8540891","resolution":{"observed_at":"2026-08-07T12:01:08.712974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15513","last_updated":"2025-06-14T16:04:31Z","snapshot_observed_at":"2026-08-03T06:34:42.243765Z","submitted_at":"2024-06-20T18:37:36Z","title":"PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15513","snapshot_observed_at":"2026-08-07T12:01:08.749164Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.749164Z"},"links":{"cited_paper":"/paper/2406.15513","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:d59f0cb81fad590d49febc38864da5a8e64cb0d71166e39071065727266127cb","observation_id":"eefbd577-524a-4cc1-a8d0-3faa2c8147af","resolution":{"observed_at":"2026-08-07T12:01:08.749164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.149348Z","title":"Jiang, K","venue":null,"work_id":"280737cd-23d5-47a6-840e-aec9e3e838fd","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.790854Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:2ca73d78e2a914bd4ae4a621ae93183763948487f3bf7a2b75d1f5ea68e67e26","observation_id":"f96588aa-b5a8-47c9-a3a3-77cb239334db","resolution":{"observed_at":"2026-08-07T12:01:15.216923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18540","last_updated":"2025-02-28T14:49:25Z","snapshot_observed_at":"2026-08-07T03:50:11.725849Z","submitted_at":"2024-05-28T19:16:17Z","title":"Learning diverse attacks on large language models for robust red-teaming and safety tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18540","snapshot_observed_at":"2026-08-07T12:01:08.855205Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.855205Z"},"links":{"cited_paper":"/paper/2405.18540","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:bc2931ff3be69fd095ce6d1b34780e817699ac7e53c0418b0449bb7afba652bd","observation_id":"8b7839bf-1144-4e59-9590-e49c9f2bbb38","resolution":{"observed_at":"2026-08-07T12:01:08.855205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.035699Z","title":null,"venue":null,"work_id":"f32c5ad7-323c-4289-a088-986ba6141822","year":2025},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.904306Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:70043b06f692353abaa8bb818d54fa01906125fa02a0e23c84363dc4095ff1b7","observation_id":"d9d7b985-ec8f-438f-b860-4a5163b078c8","resolution":{"observed_at":"2026-08-07T12:01:15.081114Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07921","last_updated":"2024-11-24T18:03:43Z","snapshot_observed_at":"2026-07-06T17:58:56.081219Z","submitted_at":"2024-04-11T17:05:50Z","title":"AmpleGCG: Learning a Universal and Transferable Generative Model of Adversarial Suffixes for Jailbreaking Both Open and Closed LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07921","snapshot_observed_at":"2026-08-07T12:01:08.949311Z","title":"Liao and H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.949311Z"},"links":{"cited_paper":"/paper/2404.07921","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:04328fe4cf9909eb03ba52e2a15c689a639b88bea590e9966948dc40db271262","observation_id":"caa11580-6c71-4128-ad4f-253b6c47ab5d","resolution":{"observed_at":"2026-08-07T12:01:08.949311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05295","last_updated":"2025-04-22T05:20:39Z","snapshot_observed_at":"2026-07-06T19:29:14.335016Z","submitted_at":"2024-10-03T17:59:01Z","title":"AutoDAN-Turbo: A Lifelong Agent for Strategy Self-Exploration to Jailbreak LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05295","snapshot_observed_at":"2026-08-07T12:01:09.010611Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.010611Z"},"links":{"cited_paper":"/paper/2410.05295","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:84e1b4d275030cd5edabd0c1c823008abf17baa36a63c007b1b9801d12b3acfc","observation_id":"33b04a5e-5201-4103-a505-f126f201da8a","resolution":{"observed_at":"2026-08-07T12:01:09.010611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:14.865966Z","title":null,"venue":null,"work_id":"e940ec46-b532-441f-9afa-1afb79d51871","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.049209Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:c156fc1f10a5d68e4a50b32f6ac95866d20c0dcaa3c5822f118a8096e2cd90df","observation_id":"79503cc3-a8ae-4757-97cc-c009a116ff06","resolution":{"observed_at":"2026-08-07T12:01:14.920262Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01830","last_updated":"2025-01-03T14:30:14Z","snapshot_observed_at":"2026-08-03T11:54:32.402984Z","submitted_at":"2025-01-03T14:30:14Z","title":"Auto-RT: Automatic Jailbreak Strategy Exploration for Red-Teaming Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01830","snapshot_observed_at":"2026-08-07T12:01:09.082636Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.082636Z"},"links":{"cited_paper":"/paper/2501.01830","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:43e781ae256da919eb9cf7fba08f191dc52ddb08f69cfd4be38e0b6dd552b3f7","observation_id":"7ef22d1b-236d-4d76-b9a5-70094e50e563","resolution":{"observed_at":"2026-08-07T12:01:09.082636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:14.722279Z","title":"Mazeika, L","venue":null,"work_id":"45c80049-022f-4436-9bbf-2aa4280ef2c1","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.159736Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:c9d6c68287e57a1aeab24e572bc1176a997fbd82e099482ebc27478bff513353","observation_id":"9f76d43c-b567-41d5-8d90-ffe9b0a7e40a","resolution":{"observed_at":"2026-08-07T12:01:14.799153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:14.580024Z","title":"Mehrotra, M","venue":null,"work_id":"28e2fc39-b130-4ec3-8f63-9f8694950bab","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.219879Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:aba4004ed6093b97126807ebe9086335733d9f9ad6c997fdc05d29d3ec472825","observation_id":"b1e15a24-cb77-4191-9ab0-92c61ff84c58","resolution":{"observed_at":"2026-08-07T12:01:14.626933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:14.407513Z","title":"Gpt-3.5 turbo, 2023","venue":null,"work_id":"3b68ca0f-5da9-49e6-9294-250cc5195d7e","year":2023},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.278456Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:1eff2d26a42980547dc14cdc72390a693e4911c3d96c672089c1441c965841ba","observation_id":"566053bd-80f3-4d37-853f-df3a49293b28","resolution":{"observed_at":"2026-08-07T12:01:14.498579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:14.241486Z","title":"Gpt-4o system card, 2024a","venue":null,"work_id":"9d1308e6-c4e7-4f6d-919f-8c3161359b4d","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.326484Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:b12776e55da841e4791688d8de157fa1ff89a27887305005bd3ff0d6c158e312","observation_id":"626e1ff1-468b-4aaa-bfb7-e71a93d30c8f","resolution":{"observed_at":"2026-08-07T12:01:14.309406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16873","last_updated":"2025-06-02T18:59:01Z","snapshot_observed_at":"2026-08-05T10:26:02.067012Z","submitted_at":"2024-04-21T22:18:13Z","title":"AdvPrompter: Fast Adaptive Adversarial Prompting for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16873","snapshot_observed_at":"2026-08-07T12:01:09.355215Z","title":"Paulus, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.355215Z"},"links":{"cited_paper":"/paper/2404.16873","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:63580e8ad345f8d217802241e968ce477f06b272bc42930b2d9cf27dbd78e938","observation_id":"08782bc4-4c05-447a-8f7a-e6054cf6024a","resolution":{"observed_at":"2026-08-07T12:01:09.355215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:14.036058Z","title":"Perez, S","venue":null,"work_id":"604bba43-7e9d-4e6e-96e8-077007903d1a","year":2022},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.433892Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:80dd81151e4aa89b62c6a356b7b5c625e4d17f52321710872ad9890d4b2cd766","observation_id":"e8db39e9-155c-47b6-9fc9-841594d08b36","resolution":{"observed_at":"2026-08-07T12:01:14.151394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13958","last_updated":"2025-04-16T21:45:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-16T21:45:32Z","title":"ToolRL: Reward is All Tool Learning Needs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13958","snapshot_observed_at":"2026-08-07T12:01:09.512168Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.512168Z"},"links":{"cited_paper":"/paper/2504.13958","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:7bf5ee6321cd516479da5eaf94f379ae54277ec573decf2fbf2409c18d88ddc1","observation_id":"8608203b-ab0d-4b7d-9e6d-5f5952b7c7aa","resolution":{"observed_at":"2026-08-07T12:01:09.512168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:13.780458Z","title":"Samvelyan, S","venue":null,"work_id":"45cc2aca-2952-42b6-9588-84b4c0bc4f56","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.600327Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:3346824e1db1ae0338171211182e18191c6ed27d458d6624e90b11a7c10061f9","observation_id":"a61ec825-55bf-40eb-92e3-e9999b760f4e","resolution":{"observed_at":"2026-08-07T12:01:13.886647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:01:09.657922Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.657922Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:ee1444c0d1027b20aee2f36986d3c920c6cfc74aea464092de0fdef6cc964c62","observation_id":"2fe3d659-1d9e-4572-83d3-d16129c3df13","resolution":{"observed_at":"2026-08-07T12:01:09.657922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:13.553746Z","title":"Shaikh, H","venue":null,"work_id":"cf609089-76fb-48bc-aa30-3cca290abed6","year":2023},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.746566Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:3a9f947e99101507007ab2a03b7e75366436c1a404b449af9f44c74072c87212","observation_id":"337364ca-5d04-4c9d-aa9e-140249eaeb30","resolution":{"observed_at":"2026-08-07T12:01:13.639232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T12:01:09.833907Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.833907Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:d7084fbb0dd05cb1fe78f775582571528e84c928ccb14b971cb3913770ffad4e","observation_id":"33a0d048-074e-4b90-8607-1d344d8b45c1","resolution":{"observed_at":"2026-08-07T12:01:09.833907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:09.906691Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.906691Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:476c46cc70e1d380c5478fd8f16f84a007aaba435afc20c4a4bb144ce1ca189e","observation_id":"1da0f343-f8de-4521-ae3e-d911e0b7fecd","resolution":{"observed_at":"2026-08-07T12:01:09.906691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T12:01:10.034542Z","title":"Touvron, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.034542Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:8a6aed3009f08c4b436f81492dae0a83c517106c160a4df692263076c2e6a08e","observation_id":"c80dcfb9-4c3d-4a0d-b3d0-46c2a6f5d20a","resolution":{"observed_at":"2026-08-07T12:01:10.034542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:13.304961Z","title":"Wang and K","venue":null,"work_id":"655a5e61-9e69-4ef7-8208-8485c90f03fb","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.174828Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:f72e828f4741a16391027a5a8611dd373810b20856e816be33f19ca292ace73b","observation_id":"20bb5f9f-9282-4eea-9926-6fe1ae134672","resolution":{"observed_at":"2026-08-07T12:01:13.402890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T12:01:10.230800Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.230800Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:ae179c35ba7196bf2165361436989ddad196f3449ab9a8831b8c47823148ceef","observation_id":"9116b090-aef8-4210-95f5-bf89a5cdba32","resolution":{"observed_at":"2026-08-07T12:01:10.230800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:13.075965Z","title":null,"venue":null,"work_id":"caf61788-9b38-4e7e-84c0-47b84483f529","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.304646Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:23dee8e56e9755c8d6b0ed41d964cf74cffb07836a107556e5119d0aa8bcd027","observation_id":"964183fa-aa52-49f2-927f-c5173047915a","resolution":{"observed_at":"2026-08-07T12:01:13.185963Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02384","last_updated":"2025-06-27T07:30:35Z","snapshot_observed_at":"2026-07-06T20:30:59.454606Z","submitted_at":"2025-02-04T15:02:55Z","title":"STAIR: Improving Safety Alignment with Introspective Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02384","snapshot_observed_at":"2026-08-07T12:01:10.437566Z","title":"Zhang, S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.437566Z"},"links":{"cited_paper":"/paper/2502.02384","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:a1599769b3f408ddef783fe682413bc9ce85c6566226f14542553c849e022cc5","observation_id":"d46e43ee-3901-486a-9347-9043cb9922c4","resolution":{"observed_at":"2026-08-07T12:01:10.437566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:12.961673Z","title":null,"venue":null,"work_id":"21589045-5fc6-4a60-bc98-6c0fcef52adb","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.548907Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:3f7bed4b826fec06037b231f652632918216bf296addd870c38cd26a699796db","observation_id":"9be8f1ce-bb31-4409-9aea-d7454a72728f","resolution":{"observed_at":"2026-08-07T12:01:13.013773Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10977","last_updated":"2024-06-16T15:24:50Z","snapshot_observed_at":"2026-07-06T18:31:45.125236Z","submitted_at":"2024-06-16T15:24:50Z","title":"Toward Optimal LLM Alignments Using Two-Player Games","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10977","snapshot_observed_at":"2026-08-07T12:01:10.671950Z","title":"Zheng, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.671950Z"},"links":{"cited_paper":"/paper/2406.10977","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:facf1a39b9dfff9eb8a909b7bfc6c6fee99668b2160eb418c559f334bfa581c0","observation_id":"0aeb746e-80aa-4229-83f4-d714ffbf2ddf","resolution":{"observed_at":"2026-08-07T12:01:10.671950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15754","last_updated":"2025-03-20T00:13:04Z","snapshot_observed_at":"2026-08-07T16:50:24.795091Z","submitted_at":"2025-03-20T00:13:04Z","title":"AutoRedTeamer: Autonomous Red Teaming with Lifelong Attack Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15754","snapshot_observed_at":"2026-08-07T12:01:10.771523Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.771523Z"},"links":{"cited_paper":"/paper/2503.15754","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:744a4bcc88a15e18a27e75a31c24ffc8138e741ea900e8c4d705c17c312add3f","observation_id":"362e0e77-debc-4ddb-a8c9-f1c8227e1e3d","resolution":{"observed_at":"2026-08-07T12:01:10.771523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01850","last_updated":"2024-07-01T23:25:30Z","snapshot_observed_at":"2026-08-01T03:52:37.266248Z","submitted_at":"2024-07-01T23:25:30Z","title":"Purple-teaming LLMs with Adversarial Defender Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01850","snapshot_observed_at":"2026-08-07T12:01:10.911575Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.911575Z"},"links":{"cited_paper":"/paper/2407.01850","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:b74124a22bd80a4e6fe3274138aea4a093e66188b6562f1d9235c64f46d6a06f","observation_id":"ed3ab69c-a3f5-45fb-a68a-4206b040c247","resolution":{"observed_at":"2026-08-07T12:01:10.911575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T12:01:11.128250Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:11.128250Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:15e34c8d87865055f48d0c08c654d628873c2ff48204f9fece240b9d80817cfb","observation_id":"cc43c2c8-46e6-48aa-b081-3da843160ed5","resolution":{"observed_at":"2026-08-07T12:01:11.128250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:12.740780Z","title":"After obtaining the filtered 2k samples, we prompt the Qwen2.5-7B-Instruct model to imitate the sample attack as an example","venue":null,"work_id":"0df61afa-a30f-4091-b960-0acc0c0c9ea8","year":null},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:11.261804Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:8b0c73a96f6430b9a1aa489bdf0394f93c59804f19ae177f158cc6147f271d4d","observation_id":"2d3ff433-976c-4255-ac9a-da42342f056e","resolution":{"observed_at":"2026-08-07T12:01:12.850546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:12.534169Z","title":null,"venue":null,"work_id":"c31020b4-f80b-4e57-83bc-be5c338ba703","year":null},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:11.473485Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:514518453a8728354d8476de2b750592ea2895bb25b202143e846b488de588c4","observation_id":"e1cf1b40-4758-4b2e-8d33-9e64c96a27d7","resolution":{"observed_at":"2026-08-07T12:01:12.612250Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 8 inbound Pith citation observations for arXiv:2506.00782."}