{"as_of":"2026-08-06T07:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b3d4ff761dc32e449fa4bf1ac8e8b49ee51487df41e8fe37574b9e65194c1784","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T21:34:51.665401Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T16:05:09.033412Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T09:21:00.875633Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"cited_work":{"arxiv_id":"2508.20325","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.20325","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6466988f-3283-4755-9b63-1dc313906ed9","year":2025},"citing_paper":{"arxiv_id":"2604.10733","last_updated":"2026-04-12T17:12:55Z","snapshot_observed_at":"2026-07-06T22:59:18.756089Z","submitted_at":"2026-04-12T17:12:55Z","title":"Too Nice to Tell the Truth: Quantifying Agreeableness-Driven Sycophancy in Role-Playing Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-10T16:05:09.033412Z"},"links":{"cited_paper":"/paper/2508.20325","citing_paper":"/paper/2604.10733"},"observation_digest":"sha256:ed360d0892d38b89241afcf511906ef0f2873b822a6cf49bfd5c267597864272","observation_id":"cc542535-d662-4c85-8865-a815766dbdf2","resolution":{"observed_at":"2026-05-12T03:42:01.658650Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.20325/citation-record","integrity":"/paper/2508.20325/integrity","json":"/paper/2508.20325/citation-record.json","paper":"/paper/2508.20325"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Journal of experimental political science 9(1), 104–117 (2022)","venue":null,"work_id":"87c29799-7274-4750-8927-c3e6b2872f77","year":2022},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:99579563b8fdb591a0ac3bfa5a2f21af7716604a7959130a4902f6b7eabf9e86","observation_id":"9f9d800a-8f84-435a-a63d-65f7e40f39df","resolution":{"observed_at":"2026-05-18T21:42:51.510498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04246","last_updated":"2023-01-10T23:42:30Z","snapshot_observed_at":"2026-08-05T01:34:42.166989Z","submitted_at":"2023-01-10T23:42:30Z","title":"Generative Language Models and Automated Influence Operations: Emerging Threats and Potential Mitigations","version":1},"cited_work":{"arxiv_id":"2301.04246","doi":"10.48550/arxiv.2301.04246","metadata_source":"arxiv_reference","pith_arxiv_id":"2301.04246","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A., Sastry, G., Musser, M., DiResta, R., Gentzel, M., & Katerina Sedova","venue":"arXiv (Cornell University)","work_id":"b2715c0f-e691-480a-8037-9a5e8b8ba009","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2301.04246","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:04c62c8b4d262dedf77e727bd7e64b6c3980bdc13960bdb6eab49d7db7532d6c","observation_id":"17c02676-cb49-44b3-9322-6652d95bacfc","resolution":{"observed_at":"2026-05-18T21:36:52.538697Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Computer Law Review International 20(4), 97–106 (2019) 14","venue":null,"work_id":"1f0f42e6-15a0-496a-99ef-67d2f1f0e479","year":2019},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:9fec27cd2729236d41a476a5486ea786ff107c75901bc30bb8a8c3c63c912e45","observation_id":"b6e80b81-4dcd-4456-8b7d-eb0beca2dcf9","resolution":{"observed_at":"2026-05-18T21:42:51.507524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https:// www.aepd.es/sites/default/files/2019-12/ai-ethics-guidelines.pdf","venue":null,"work_id":"23e92ddf-90ea-475d-bcd4-67c335297b51","year":2019},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:706b342d8b163978abb5296eea7940663854b6066d85fa1054f76ff77bf53e41","observation_id":"617d0056-91d9-4b76-b5a3-4e7f565a3e5b","resolution":{"observed_at":"2026-05-18T21:42:51.520473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03825","last_updated":"2024-05-15T12:06:31Z","snapshot_observed_at":"2026-07-06T16:03:34.432602Z","submitted_at":"2023-08-07T16:55:20Z","title":"\"Do Anything Now\": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models","version":2},"cited_work":{"arxiv_id":"2308.03825","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.03825","snapshot_observed_at":"2026-07-10T17:17:25.614333Z","title":"\"Do Anything Now\": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models","venue":"cs.CR","work_id":"73c8e776-cd59-4029-b3fe-4579d64d9014","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2308.03825","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:a641d157b1795933f686b439585d282fd838749d4920d1aa192e409c8624d3dc","observation_id":"36a52f62-46d2-4e14-b124-ab9ce795e576","resolution":{"observed_at":"2026-05-18T21:36:52.543549Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Retrieved August 24, 2018 (2016)","venue":null,"work_id":"8a6a78e4-b875-41c9-bb54-3b7f449d25d1","year":2018},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:4560d4b5dc965dc0cbd02ade26949a78c3313cfaaeaaeb0af1f1f303e7644a4e","observation_id":"c96c01fc-a47a-49e4-a28e-f55a81956a11","resolution":{"observed_at":"2026-05-18T21:42:51.501505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://www.whitehouse","venue":null,"work_id":"b80f626f-6e49-4da6-835e-b22fcc926687","year":2022},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:217dcbce31ee515a010b297877eb29bbb7d19cabc9dda3d8698af030eb3cc7de","observation_id":"fd47df4b-6d1b-40c3-b1fd-7424c6a93547","resolution":{"observed_at":"2026-05-18T21:42:51.513184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https: //www.whitehouse.gov/briefing-room/presidential-actions/2023/10/30/ executive-order-on-the-safe-secure-and-trustworthy-development-and-use-of-artificial-intelligence/","venue":null,"work_id":"7b8134d8-107d-4226-b3f2-1530a61a216a","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:6439b8dca42eaa07924abd6c5cee40e412ffd5cae7156658ce917dd487ade90c","observation_id":"dd16909e-5b76-4ffa-84f8-68abfe4b6a1c","resolution":{"observed_at":"2026-05-18T21:42:51.504555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://www.nist.gov/itl/ai-risk-management-framework","venue":null,"work_id":"00a81396-62fd-4a89-9c6b-633ad60feb74","year":2024},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:d3eeed0e6a94440e030595ce4f9c52ce4c00917fa6c6ed792120d89901f34f79","observation_id":"6753390a-b2c7-48c6-90a3-c457f2451d9e","resolution":{"observed_at":"2026-05-18T21:42:51.516573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https:// assets.publishing.service.gov.uk/media/64cb71a547915a00142a91c4/ a-pro-innovation-approach-to-ai-regulation-amended-web-ready.pdf","venue":null,"work_id":"61a23c40-038d-49e5-a71a-27976a24b6f5","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:7abb06ec24435583582885e86abc57a593e061a83578c53f86eb6ba1ee7f9b70","observation_id":"3af16540-817b-4bf9-b7e9-95e2647b4e4c","resolution":{"observed_at":"2026-05-18T21:42:51.524524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://artificialintelligenceact.eu/ ai-act-explorer/","venue":null,"work_id":"96f1bbf3-5520-4b3c-969b-c53b8fdef4c2","year":2024},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:4fca25784a4f75dd977abb2a72983f701154815a08c49817ff281b25811256f9","observation_id":"dc8c2dad-3780-4218-b9d1-d4dbaed9545b","resolution":{"observed_at":"2026-05-18T21:42:51.529510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07924","last_updated":"2024-06-05T13:23:49Z","snapshot_observed_at":"2026-07-06T15:54:28.831510Z","submitted_at":"2023-07-16T02:11:34Z","title":"ChatDev: Communicative Agents for Software Development","version":5},"cited_work":{"arxiv_id":"2307.07924","doi":"10.48550/arxiv.2307.07924","metadata_source":"pith","pith_arxiv_id":"2307.07924","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ChatDev: Communicative Agents for Software Development","venue":"cs.SE","work_id":"5d8a3650-ab78-4991-b0d3-5309b59c690f","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2307.07924","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:b088cebff1ebcf0dade5e54834309a080815a1bbdaacc151260ddd3bc6ff56f4","observation_id":"d3255833-f4a6-456b-8cee-eea0a074bc9e","resolution":{"observed_at":"2026-05-18T21:36:52.430664Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00352","last_updated":"2024-11-01T14:36:52Z","snapshot_observed_at":"2026-07-06T16:01:07.532053Z","submitted_at":"2023-08-01T07:49:10Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","version":7},"cited_work":{"arxiv_id":"2308.00352","doi":"10.48550/arxiv.2308.00352","metadata_source":"pith","pith_arxiv_id":"2308.00352","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","venue":"cs.AI","work_id":"891b9780-a800-4e3c-bba0-53597ab8dc98","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2308.00352","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:5682033a607dfb965e84dbb71f207758d874a711a6ac28c9627757ab3144d515","observation_id":"0f8952ac-551d-4905-889c-920b7e5bc657","resolution":{"observed_at":"2026-05-18T21:36:52.388845Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":"2305.16291","doi":"10.18653/v1/2023.emnlp-main.118","metadata_source":"pith","pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","venue":"cs.AI","work_id":"ffe0d207-86cf-4742-a100-e988ac8b9676","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:696460fe520737839e9818465c0211ed6226ac026f21c288b103e139d06cb750","observation_id":"d9da99c8-fa42-40dc-9037-86276faca79b","resolution":{"observed_at":"2026-05-18T21:36:52.379499Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 36th Annual Acm Symposium on User Interface Software and Technology, pp","venue":null,"work_id":"1d39dd37-4ea2-4a46-ab0d-8bde0e8ee4e6","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:4620f2401ad2fca00b8ab6eac8cece0b82890fdba36a61e16ce54a20dc81ddea","observation_id":"b54939ce-00ce-420e-87cd-32ade625a2bb","resolution":{"observed_at":"2026-05-18T21:41:53.103068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08922","last_updated":"2023-07-18T01:43:00Z","snapshot_observed_at":"2026-07-06T15:55:06.149983Z","submitted_at":"2023-07-18T01:43:00Z","title":"Large Language Models Perform Diagnostic Reasoning","version":1},"cited_work":{"arxiv_id":"2307.08922","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08922","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2307.08922 (2023)","venue":null,"work_id":"e05f08c8-af28-4c29-8dd4-cedeabec4100","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2307.08922","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:ce18a04a7ae5b8a5c3428ccafc9d2b88bc666102343be89f744ab7e6ec532d59","observation_id":"50bc6b1c-d234-463a-89f7-0ea1aeb79db7","resolution":{"observed_at":"2026-05-18T21:36:52.384146Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10537","last_updated":"2024-06-04T23:47:43Z","snapshot_observed_at":"2026-07-06T16:49:04.651019Z","submitted_at":"2023-11-16T11:47:58Z","title":"MedAgents: Large Language Models as Collaborators for Zero-shot Medical Reasoning","version":4},"cited_work":{"arxiv_id":"2311.10537","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.10537","snapshot_observed_at":"2026-07-10T18:57:31.502122Z","title":"Medagents: Large language models as collaborators for zero-shot medical reasoning","venue":"cs.CL","work_id":"99aadd26-1123-4a2f-b26c-6ab3e29b450f","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2311.10537","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:1b1cf294cf4398907d6e66514f68123fc130b7beb6d0767fe20000692aa78274","observation_id":"3cb5697e-cea7-4fca-8936-27bc01d45e1a","resolution":{"observed_at":"2026-05-18T21:36:52.374799Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07201","last_updated":"2023-08-14T15:13:04Z","snapshot_observed_at":"2026-08-02T01:34:38.978920Z","submitted_at":"2023-08-14T15:13:04Z","title":"ChatEval: Towards Better LLM-based Evaluators through Multi-Agent Debate","version":1},"cited_work":{"arxiv_id":"2308.07201","doi":"10.48550/arxiv.2308.07201","metadata_source":"pith","pith_arxiv_id":"2308.07201","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ChatEval: Towards Better LLM-based Evaluators through Multi-Agent Debate","venue":"cs.CL","work_id":"eac74d79-d8d1-49dd-8565-53d713a84fff","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2308.07201","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:124e5b1856718b020c3f27295f66542135d7bc6fd14f14a8fd170de62d05eb79","observation_id":"3f102d19-6d21-413d-af7b-8eade6e78125","resolution":{"observed_at":"2026-05-18T21:36:52.369906Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems 35, 24824–24837 (2022)","venue":null,"work_id":"8fa1c506-d73e-46f8-82d6-0c2c7b683e79","year":2022},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:bfedcb797eb5b09c74ff45329a56f4cbcb2a88916f8c8538f49f6b6da6528f0f","observation_id":"1a6a6f27-68d6-4b5a-8c6d-27446e64585a","resolution":{"observed_at":"2026-05-18T21:41:53.106256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05197","last_updated":"2023-11-01T05:14:01Z","snapshot_observed_at":"2026-07-06T15:14:24.794122Z","submitted_at":"2023-04-11T13:05:04Z","title":"Multi-step Jailbreaking Privacy Attacks on ChatGPT","version":3},"cited_work":{"arxiv_id":"2304.05197","doi":"10.48550/arxiv.2304.05197","metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05197","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-step Jailbreaking Privacy Attacks on ChatGPT","venue":"arXiv (Cornell University)","work_id":"7cb35d81-5362-4753-874b-a92705c42c6e","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2304.05197","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:a46432c23f4baaa5ee6cf9f680e80a29a2fa8e4b601d38e591ae1673020e2706","observation_id":"ef35f386-b49d-4051-89c1-c0d2990413b2","resolution":{"observed_at":"2026-05-18T21:36:52.522996Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08979","last_updated":"2023-10-05T13:27:12Z","snapshot_observed_at":"2026-07-30T23:17:31.332560Z","submitted_at":"2023-04-18T13:20:45Z","title":"In ChatGPT We Trust? Measuring and Characterizing the Reliability of ChatGPT","version":2},"cited_work":{"arxiv_id":"2304.08979","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.08979","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2304.08979 (2023)","venue":null,"work_id":"32c14ecb-0ea0-47ec-a36b-ddf4d4387a91","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2304.08979","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:8021835dd47761607bcf1b3d35e598d4d110ce95c2491adc0c5f66b1419102f4","observation_id":"ba88cf10-a96b-4307-8f2c-e877ff3e2726","resolution":{"observed_at":"2026-05-18T21:36:52.393660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.15980","last_updated":"2020-11-07T05:33:35Z","snapshot_observed_at":"2026-08-05T14:17:34.026911Z","submitted_at":"2020-10-29T22:54:00Z","title":"AutoPrompt: Eliciting Knowledge from Language Models with Automatically Generated Prompts","version":2},"cited_work":{"arxiv_id":"2010.15980","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.15980","snapshot_observed_at":"2026-07-10T15:27:20.065753Z","title":"L., Wallace, E., and Singh, S","venue":"cs.CL","work_id":"1b968c9c-9b73-409a-aa88-57e02917679c","year":2020},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2010.15980","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:4baa653efa9ab5702966ccd077c98e1c5aad439be0dea299ab0e985b1f15a99f","observation_id":"4b7e8fc8-a251-4518-9670-6ab5593c6d32","resolution":{"observed_at":"2026-05-18T21:36:52.453943Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04381","last_updated":"2023-03-08T05:09:59Z","snapshot_observed_at":"2026-07-06T15:00:01.455874Z","submitted_at":"2023-03-08T05:09:59Z","title":"Automatically Auditing Large Language Models via Discrete Optimization","version":1},"cited_work":{"arxiv_id":"2303.04381","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04381","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Automatically auditing large language models via discrete optimization","venue":null,"work_id":"25b6d6f0-fd83-4f8f-8056-9496fa68278e","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2303.04381","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:1bcb59031a0c9c0585b46c428042890e4f86dbd92c71e08f9c669c8ca1b9909f","observation_id":"ef1d3bf9-f50f-4b5e-be1a-336db1a2e088","resolution":{"observed_at":"2026-05-18T21:36:52.469255Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":"2307.15043","doi":"10.48550/arxiv.2307.15043","metadata_source":"pith","pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","venue":"cs.CL","work_id":"3322fa86-1768-4677-8425-dd326b45e078","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:c838bdb44d48a71a7585904b5c40e146489aa7a1483ffa1b70d77a0fed3d9e97","observation_id":"c058c589-b1a6-4851-92fd-d14f34da76e6","resolution":{"observed_at":"2026-05-18T21:36:52.491112Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15140","last_updated":"2023-12-14T06:22:51Z","snapshot_observed_at":"2026-08-03T19:47:58.067345Z","submitted_at":"2023-10-23T17:46:07Z","title":"AutoDAN: Interpretable Gradient-Based Adversarial Attacks on Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.15140","doi":"10.48550/arxiv.2310.15140","metadata_source":"pith","pith_arxiv_id":"2310.15140","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Auto- DAN: Automatic and Interpretable Adversarial Attacks on Large Language Models","venue":"cs.CR","work_id":"cc605bcf-1f90-4b4e-bd3c-2c4a2207d263","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2310.15140","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:2b6f11724d908332cdffc8313266a64e8b3cf5e090d8876d56365cddfec009cf","observation_id":"ebb79019-4428-4388-acd3-2fcb2098df84","resolution":{"observed_at":"2026-05-18T21:36:52.459033Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-07-06T15:54:58.589775Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":"2307.08715","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-07-03T01:47:31.647956Z","title":"Jail- breaker: Automated jailbreak across multiple large language model chatbots","venue":null,"work_id":"aa1418bb-738e-4eb1-a94f-4bc672faaef3","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:d3910dcfabd822c21d0ee5e6ed0e3279cca0b3fbf9c34d853861269c970f79ba","observation_id":"a5be04eb-7089-4b62-a33c-3f3cd94f841e","resolution":{"observed_at":"2026-05-18T21:36:52.533755Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06387","last_updated":"2024-05-25T07:01:15Z","snapshot_observed_at":"2026-07-06T16:30:21.245398Z","submitted_at":"2023-10-10T07:50:29Z","title":"Jailbreak and Guard Aligned Language Models with Only Few In-Context Demonstrations","version":3},"cited_work":{"arxiv_id":"2310.06387","doi":"10.48550/arxiv.2310.06387","metadata_source":"pith","pith_arxiv_id":"2310.06387","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbreak and guard aligned language models with only few in-context demonstrations","venue":"cs.LG","work_id":"4fe10dc2-a8a4-46ec-bb39-b0edae135f1d","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2310.06387","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:468430fc69322adc84b7b9ce8686646603ccdab3e5cec1d5bd690f82eb0153fd","observation_id":"921a1417-8384-499b-97e9-4bdae34b8f08","resolution":{"observed_at":"2026-05-18T21:36:52.479691Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:10.432951+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:10.432951+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":"2310.08419","doi":"10.48550/arxiv.2310.08419","metadata_source":"pith","pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","venue":"cs.LG","work_id":"38678cda-6595-4ca3-916b-066c00cce063","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:9dc7c07b9cf92d6c2ffbdfbeeb5bccd0f5a5b257fe720264f7cba32154f14fd9","observation_id":"f92ea18d-b282-49f0-94a7-78cc624a958d","resolution":{"observed_at":"2026-05-18T21:36:52.473897Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:06.618013+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:06.618013+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03348","last_updated":"2023-11-24T12:50:31Z","snapshot_observed_at":"2026-08-05T10:39:14.391116Z","submitted_at":"2023-11-06T18:55:18Z","title":"Scalable and Transferable Black-Box Jailbreaks for Language Models via Persona Modulation","version":2},"cited_work":{"arxiv_id":"2311.03348","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.03348","snapshot_observed_at":"2026-07-04T19:50:11.090116Z","title":"arXiv preprint arXiv:2311.03348 (2023)","venue":null,"work_id":"ae0f14e0-eb2e-4516-b895-79c9b5a2cc0d","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2311.03348","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:71440028f6db279bff385e1074730d3f5dfef0129f87785d77785d8ae3d01d56","observation_id":"51bae0dc-effd-4724-9804-6e3ad33b4bdb","resolution":{"observed_at":"2026-05-18T21:36:52.516771Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12329","last_updated":"2024-12-07T23:09:49Z","snapshot_observed_at":"2026-07-06T17:32:24.161667Z","submitted_at":"2024-02-19T18:01:36Z","title":"Query-Based Adversarial Prompt Generation","version":2},"cited_work":{"arxiv_id":"2402.12329","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.12329","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2402.12329 (2024)","venue":null,"work_id":"8f36413f-b5f1-4691-bc32-5a2b817e5b7a","year":2024},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2402.12329","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:0e28c63e9131b7eac230e73d2eb335012cfff280a517db718c67b58e221e09ee","observation_id":"de79b5a9-c7fc-4908-8bde-64d2917fcd92","resolution":{"observed_at":"2026-05-18T21:36:52.402868Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07865","last_updated":"2024-09-14T11:41:49Z","snapshot_observed_at":"2026-07-06T17:43:27.034067Z","submitted_at":"2024-03-12T17:55:38Z","title":"CodeAttack: Revealing Safety Generalization Challenges of Large Language Models via Code Completion","version":5},"cited_work":{"arxiv_id":"2403.07865","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.07865","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2403.07865 (2024)","venue":null,"work_id":"9e02d1cc-a904-45a4-a661-96870be439e2","year":2024},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2403.07865","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:1f712fd0357e7ede637af927a867bd148acf9675620dcfae9749638d8d00105b","observation_id":"cb1b8fd8-a396-4c50-8c2c-42e2b2672dbc","resolution":{"observed_at":"2026-05-18T21:36:52.485500Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16914","last_updated":"2024-11-11T23:08:20Z","snapshot_observed_at":"2026-07-06T17:35:45.288097Z","submitted_at":"2024-02-25T17:43:29Z","title":"DrAttack: Prompt Decomposition and Reconstruction Makes Powerful LLM Jailbreakers","version":3},"cited_work":{"arxiv_id":"2402.16914","doi":"10.48550/arxiv.2402.16914","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.16914","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2402.16914 (2024)","venue":"arXiv (Cornell University)","work_id":"ea7bde13-246e-40f1-be95-d23e27ab5dc9","year":2024},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2402.16914","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:e9125e757c4fa96a20aa443952f9ee8f8fab6699d5626f1a776bbff3a723bb21","observation_id":"5c51fca5-3ace-4ed8-aead-76b29948150c","resolution":{"observed_at":"2026-05-18T21:36:52.445155Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06463","last_updated":"2024-03-26T04:23:12Z","snapshot_observed_at":"2026-07-06T16:05:31.757410Z","submitted_at":"2023-08-12T04:05:57Z","title":"GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher","version":2},"cited_work":{"arxiv_id":"2308.06463","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.06463","snapshot_observed_at":"2026-07-09T10:26:11.073540Z","title":"Gpt- 4 is too smart to be safe: Stealthy chat with llms via cipher","venue":"cs.CL","work_id":"c0bea3ab-35ce-4045-8b4f-46d34943d688","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2308.06463","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:88fd759b71cb31f453f97a23da9ecf858c4987436097689ed8240c38581cc727","observation_id":"9f740cc8-976e-4e1b-bdac-fa4eb26f8472","resolution":{"observed_at":"2026-05-18T21:36:52.497769Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2402.10601","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2402.10601 (2024)","venue":null,"work_id":"a458b4e7-eb49-4cc2-a532-131323522e41","year":2024},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:00e51c5e3d2803f2920f866015230f2678c5d1884ebf3c5b6b6457e9716a7296","observation_id":"7c05e2e6-6f84-4eb6-bb9b-85156b3002b6","resolution":{"observed_at":"2026-05-18T21:36:52.528600Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20413","last_updated":"2024-05-30T18:38:36Z","snapshot_observed_at":"2026-07-06T18:22:57.400982Z","submitted_at":"2024-05-30T18:38:36Z","title":"Jailbreaking Large Language Models Against Moderation Guardrails via Cipher Characters","version":1},"cited_work":{"arxiv_id":"2405.20413","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20413","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2405.20413 (2024)","venue":null,"work_id":"2d755a09-da02-4879-8951-c9d7d948a885","year":2024},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2405.20413","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:ed9c9e8bf8d112cd1f79fe1d54952920c9de37a55ca1f394e4c4d0fa2c1a0f77","observation_id":"44863539-cf70-48cd-8278-ea533d6fc824","resolution":{"observed_at":"2026-05-18T21:36:52.440502Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":"2402.04249","doi":"10.48550/arxiv.2402.04249","metadata_source":"pith","pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","venue":"cs.LG","work_id":"b0b0303f-2444-4789-a979-8153624312ff","year":2024},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:5918bd695914200951f0bb0a5962a7382a9e5b9ee6beb39f0e7b526b0b50e8f5","observation_id":"373986f5-47b5-4ec7-93f6-d1525fb8a244","resolution":{"observed_at":"2026-05-18T21:36:52.464182Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Theory and Applications of Ontology: Computer Applications, pp","venue":null,"work_id":"8363620e-ac57-4b33-8324-afcefc838fac","year":2010},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:d1482a3ff133e3c345a0035b109376a35d9af413ac4eaa7b2a219587455e1d64","observation_id":"8c116005-d260-42e6-8d32-f524cffab5ee","resolution":{"observed_at":"2026-05-18T21:41:53.109543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: 2014 47th Hawaii International Conference on System Sciences, pp","venue":null,"work_id":"f5c3ae81-5346-4425-b24b-7dc5a2605ab4","year":2014},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:1852a2ff0cc4822be6ab0e33ac918026805f3dc65e3bef097ed9a6441b794537","observation_id":"2ef11fd6-9aae-4990-9fe3-7a91b7b30593","resolution":{"observed_at":"2026-05-18T21:41:53.112843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IEEE transactions on neural networks and learning systems 33(2), 494–514 (2021)","venue":null,"work_id":"6d5dfbef-b997-441e-ab94-cf8537c629a4","year":2021},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:c0412fb482c80642f4e2354ff7d6ec950a769147eba42e1efd9f35c0691e94de","observation_id":"8be137c6-aaf8-4f99-bbaf-974704d4df07","resolution":{"observed_at":"2026-05-18T21:42:51.472555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Proceedings of the 20th ACM SIGKDD International Conference on Knowledge Discovery and Data Mining, pp","venue":null,"work_id":"e63de7f1-910d-4488-9032-b23c2f52769d","year":2014},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:ebba4e4e06b6dc87be3ebb233f8e623c5f6fc6585cff753313d2b317cb544d31","observation_id":"b7468a20-16ed-4857-afa4-b956386523d6","resolution":{"observed_at":"2026-05-18T21:42:51.480798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems 36 (2024)","venue":null,"work_id":"768c0ff3-7bba-4e08-8d2c-a4b0067b305e","year":2024},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:abde5a2236ac91bee51d43159e52da83fa3207cccefc85241a06d0387afa6da2","observation_id":"a66af267-0a44-4fc0-aa9b-494d07cbae49","resolution":{"observed_at":"2026-05-18T21:42:51.498417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://lmsys.org/blog/2023-06-29-longchat","venue":null,"work_id":"f023a331-5646-4c35-bf55-c8810e620e47","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:0b13bdd24cb47d2ddf72937772a89f88fee1166ab41f5be119c0f7fe2718679d","observation_id":"abe688da-d2bf-4bcd-98bb-5fbcb186008c","resolution":{"observed_at":"2026-05-18T21:42:51.476942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-02T11:57:18.735747Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:138b604b2772fab5e289c4c0838b061cf163a6b5a92d64c9e20cbbfbad09fca4","observation_id":"0c06697e-3193-432c-a10b-b2c16b5bac22","resolution":{"observed_at":"2026-05-18T21:36:52.510207Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a2208ed4-f680-49c0-ba35-8c0168dc509b","year":2024},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:0b6f54be72e3cd6d5df17a1819436f9454ef41a2978aec584f07d5b97ed958ce","observation_id":"a0822686-31bd-454d-b969-6fbc4d60c89f","resolution":{"observed_at":"2026-05-18T21:42:51.489696Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:1f48c4de05d3c945c61cd7a05fbd04955e8d006838b94149263d66b5ca547f90","observation_id":"b0039adb-b194-496e-abf9-8576f5d0ec47","resolution":{"observed_at":"2026-05-18T21:36:52.419620Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:c6ad9973cb9ea6c8503992bb64fbf6b2f49e1c6c5db4d9e0207d2aa087268a60","observation_id":"8fee8f1f-2c85-4974-8f40-39948f62a05c","resolution":{"observed_at":"2026-05-18T21:36:52.449485Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Claude-3.5 Model Card (2024)","venue":null,"work_id":"d2bc08ca-066f-496d-943d-2801b318b585","year":2024},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:ce01ef3a132bbe0919463844e315131dc514ac33997df3dc105d51cc9dff997b","observation_id":"163d61af-a4ed-4caa-b19a-cd8c1d5de4f5","resolution":{"observed_at":"2026-05-18T21:42:51.493727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"e1863cf3-6bc5-439a-b169-2a2bb3a1ced7","year":2019},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:3e8133c6b9da7a63323d2f3356c75e5abe2f0fe6e8f548c524d6509e8301572a","observation_id":"4752f6a6-2bfc-40c6-98c3-dc21c202560e","resolution":{"observed_at":"2026-05-18T21:41:53.130547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-02T14:59:12.115203Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":"2404.01318","doi":"10.48550/arxiv.2404.01318","metadata_source":"pith","pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","venue":"cs.CR","work_id":"a8e91fcd-dc7a-457f-91b8-51f660cb3053","year":2024},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:8b0905f0aabd9cd72eb0ea7bf7791b59833475b4b1ab5cba0331f5a83300b6a0","observation_id":"b543987c-e8c9-430d-aa1e-8975058769ab","resolution":{"observed_at":"2026-05-18T21:36:52.424978Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-22T21:23:26.922897+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T21:23:26.922897+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09478","last_updated":"2023-11-07T18:25:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-14T03:22:07Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","version":3},"cited_work":{"arxiv_id":"2310.09478","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.09478","snapshot_observed_at":"2026-07-08T22:35:40.586981Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","venue":"cs.CV","work_id":"fb62cd1b-3991-40be-a987-3cfa5772b5b5","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2310.09478","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:77ffcb2b5c80488978f5f632b7fb72bef4f48be4d5b800ed3098d51ceebf96ce","observation_id":"7604c940-8b49-4e38-a32e-a5341efb20e0","resolution":{"observed_at":"2026-05-18T21:36:52.435410Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":"2309.00614","doi":"10.48550/arxiv.2309.00614","metadata_source":"pith","pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","venue":"cs.LG","work_id":"db5870ca-177b-4d1d-a08d-ee5ceab17fe3","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:8019fd14ab6feed25c094131fd5c963f9c8f22759650874e6c1d5f553441995d","observation_id":"334cbcc0-699e-4b65-9c26-658840696e42","resolution":{"observed_at":"2026-05-18T21:36:52.414153Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:31.483658+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:31.483658+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7bccad86-2fd4-4a6b-8825-daaa60799219","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:a81445816ee068f32dde64f84a963cc232899d47210162420b35bcf48f306d52","observation_id":"0716171d-da89-43a0-b878-46b3aa7e47b1","resolution":{"observed_at":"2026-05-18T21:41:53.133327Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09096","last_updated":"2024-06-12T08:28:15Z","snapshot_observed_at":"2026-08-05T11:53:45.759441Z","submitted_at":"2023-11-15T16:42:29Z","title":"Defending Large Language Models Against Jailbreaking Attacks Through Goal Prioritization","version":2},"cited_work":{"arxiv_id":"2311.09096","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.09096","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2311.09096 (2023)","venue":null,"work_id":"f1bd4c15-fdb4-4f0b-8932-1af0f1492759","year":2023},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/2311.09096","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:f67dbf60b5b473de7010d4064b31c3d4f079f1bc70b95080f9f15aacaaabe15f","observation_id":"2b7a8093-461b-4ecc-ba4e-569bd2e286d8","resolution":{"observed_at":"2026-05-18T21:36:52.409545Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1301.3781","last_updated":"2013-09-07T00:30:40Z","snapshot_observed_at":"2026-07-06T03:04:11.148340Z","submitted_at":"2013-01-16T18:24:43Z","title":"Efficient Estimation of Word Representations in Vector Space","version":3},"cited_work":{"arxiv_id":"1301.3781","doi":"10.48550/arxiv.1301.3781","metadata_source":"pith","pith_arxiv_id":"1301.3781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Efficient Estimation of Word Representations in Vector Space","venue":"cs.CL","work_id":"59edaa01-a696-45b3-9a08-5eae777a799e","year":2013},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"cited_paper":"/paper/1301.3781","citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:3ee76f5343704029a139c28c83a5c23b0fa80ad8518adafbf9e686c3def9582b","observation_id":"adda398d-c0ac-4c98-aa65-02f01bfa6911","resolution":{"observed_at":"2026-05-18T21:36:52.398224Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T06:20:53.853167+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T06:20:53.853167+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"14b0e954-837d-4a43-90e1-bc73e3513d76","year":null},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:de8fc2af8cd9155a98bb21a5043994a245f99fe838ceb8401a6e8610c478b905","observation_id":"6b0ef2a5-16a2-4f21-9b3f-45dcef4a85ac","resolution":{"observed_at":"2026-05-18T21:42:51.465212Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d581fea2-6ed4-4143-af38-e23927b07749","year":null},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:39d18ba7c3fe299742246e1fafba901337216d7e46550963ba9153d105f81af6","observation_id":"091d8c05-5855-4ce3-8e87-5d9326de851b","resolution":{"observed_at":"2026-05-18T21:42:51.484712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9fa38fb1-6450-459d-950b-7ee57a2f2c9c","year":null},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:25991d1baad9c2ac1f38fc00b7161d5e1002e366aaba458199b505face84d7e0","observation_id":"65b22d6d-10c3-45fd-b5e9-47d298672b08","resolution":{"observed_at":"2026-05-18T21:41:53.122021Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"<Example 3> Domains: Education, Consumer services Scenarios: AI systems may be difficult to interpret, leading to incorrect eval- uations or distrust among users","venue":null,"work_id":"54d0988b-b240-4400-8e98-889cf1e24a34","year":null},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:766b8bb85eb7c37b94f297f1c2e76bc9006264d6f3c646c9a12e17bc780ee8f2","observation_id":"a181bf21-cda8-432b-904f-0edbfca095ec","resolution":{"observed_at":"2026-05-18T21:41:53.124993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2d0506f8-9767-4fbf-87f0-139e242944c4","year":null},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:8c0fb37b59e0ad43dcc6df83b386d874395857905351e047522d03add8057b3b","observation_id":"0fa1df22-167a-4d4f-8988-24f4c43ac3e8","resolution":{"observed_at":"2026-05-18T21:41:53.127482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b9e89222-65b2-4284-873f-190aa6ca0c32","year":null},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:8320c66bb22c8b457c8ae2825720078246b065288323fb49626acce0de9fc180","observation_id":"a29274c5-f99d-46df-8c77-0dc20a427d0a","resolution":{"observed_at":"2026-05-18T21:41:53.115821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stay in Character!","venue":null,"work_id":"4ec3e036-adc7-42d7-9ead-a92770e80d94","year":2022},"citing_paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-18T21:34:51.665401Z"},"links":{"citing_paper":"/paper/2508.20325"},"observation_digest":"sha256:d6e9cf6aa5a5aa0bf503dcd3f2ced75847f564a0b3fe290764252f0e76244355","observation_id":"e7ccb396-daa3-4203-8ba9-2295ed8999fd","resolution":{"observed_at":"2026-05-18T21:41:53.119075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.20325","last_updated":"2026-05-11T14:12:43Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T22:19:48.389341Z","submitted_at":"2025-08-28T00:07:10Z","title":"GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":1,"metadata_mismatch":22,"parse_uncertain":0,"unresolved":7,"verified_exact":10,"verified_fuzzy":21},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 1 inbound Pith citation observation for arXiv:2508.20325."}