{"as_of":"2026-08-23T00:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:371dd581572232c3d9a17a3b41fe0bb0e9dd9937695ee1e5bee761688fed0419","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-17T09:24:13.911401Z","state":"measured"},{"denominator":143,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":143,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":88,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":88,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T06:05:12.200545Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":20,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-08-17T15:25:03.596568Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-14T17:11:00.639293Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2310.03684"},"observation_digest":"sha256:8d8892ceb8dc2a20258929a66f6b7f4bfc684a1e071b0f92c3918c55216063c2","observation_id":"5c98929d-04de-423b-b2d4-a0d746e7a400","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2402.10260","last_updated":"2024-08-27T03:32:47Z","snapshot_observed_at":"2026-08-20T20:23:20.798055Z","submitted_at":"2024-02-15T18:58:09Z","title":"A StrongREJECT for Empty Jailbreaks","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T21:28:02.745230Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2402.10260"},"observation_digest":"sha256:a16e26a544295d32a3499c7f250e4deacc657cca0b73381e88868630d262c49e","observation_id":"e8d8041c-31e1-4aaf-b901-14697704f486","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-11T16:28:21.917686Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-15T06:08:05.386345Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2404.01318"},"observation_digest":"sha256:9c3245dc61bb29182c86b4583f14443be740575ee510b22ab5c5eed1a6cc8e0b","observation_id":"a0946d21-1906-4376-9f24-de60bb06111f","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-12T17:45:10.384900Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-05-15T02:20:44.368219Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2407.04295"},"observation_digest":"sha256:0d7e477ff44f4fa6a2f93448b84d3b8b3b53b72f8c39e45289a7c1a5ccd4c4c9","observation_id":"cb10f105-f8c0-45e0-9d87-63a9a4e5c86b","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2410.09024","last_updated":"2025-04-18T14:30:31Z","snapshot_observed_at":"2026-08-16T05:17:43.289570Z","submitted_at":"2024-10-11T17:39:22Z","title":"AgentHarm: A Benchmark for Measuring Harmfulness of LLM Agents","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-14T01:35:50.992477Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2410.09024"},"observation_digest":"sha256:8f00f750de609b4807dac0279d31de9f10d41e7a45597f38bd37ae2a137548fc","observation_id":"6db8d5bf-bcd9-4c2a-92b4-6db3aa4c1d04","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-12T15:18:19.493168Z","title":"Bach (2023): Low-Resource Languages Jailbreak GPT-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14368","last_updated":"2024-11-21T18:07:46Z","snapshot_observed_at":"2026-08-20T07:51:34.925382Z","submitted_at":"2024-11-21T18:07:46Z","title":"RV4Chatbot: Are Chatbots Allowed to Dream of Electric Sheep?","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T15:18:19.493168Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2411.14368"},"observation_digest":"sha256:3377c54b952765afa7c9eedbba633af778f12aea197735be5dc8b10c70f6934d","observation_id":"325a16ab-919d-4ae6-bb93-aa886cbbac89","resolution":{"observed_at":"2026-08-12T15:18:19.493168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-12T04:53:50.564436Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.00948","last_updated":"2024-12-01T19:46:40Z","snapshot_observed_at":"2026-08-15T03:13:59.533924Z","submitted_at":"2024-12-01T19:46:40Z","title":"Uhura: A Benchmark for Evaluating Scientific Question Answering and Truthfulness in Low-Resource African Languages","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T04:53:50.564436Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2412.00948"},"observation_digest":"sha256:71ce4810e6b0933843bfc8bde15411ca3dc6e7e61f7a72b186d435faa7d5f9d3","observation_id":"05ad4eab-bcea-4e40-bfd1-acdf4810ba78","resolution":{"observed_at":"2026-08-12T04:53:50.564436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-11T21:38:38.168765Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04261","last_updated":"2024-12-05T15:41:06Z","snapshot_observed_at":"2026-08-13T14:49:22.470549Z","submitted_at":"2024-12-05T15:41:06Z","title":"Aya Expanse: Combining Research Breakthroughs for a New Multilingual Frontier","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T21:38:38.168765Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2412.04261"},"observation_digest":"sha256:24f01b5257fb069d90ef8db2a98e791cd8ab32d1a125de930b8bd6a62bf1dfd4","observation_id":"60f55bd8-5b5c-41fb-b07d-f676f96e7d5e","resolution":{"observed_at":"2026-08-11T21:38:38.168765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-11T11:17:49.105339Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.15623","last_updated":"2024-12-20T07:29:10Z","snapshot_observed_at":"2026-08-15T03:49:32.833889Z","submitted_at":"2024-12-20T07:29:10Z","title":"JailPO: A Novel Black-box Jailbreak Framework via Preference Optimization against Aligned LLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T11:17:49.105339Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2412.15623"},"observation_digest":"sha256:6b44a6c9e3061f7a58d10a3436e8c60c7d974b50561c37bb0c76e60d6f47dff9","observation_id":"4a5f5dfe-42d3-458a-9933-33c402fa66f5","resolution":{"observed_at":"2026-08-11T11:17:49.105339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-11T05:19:34.544425Z","title":"URL https://doi.org/10.18653/v1/ 2024.acl-long.124","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.17686","last_updated":"2024-12-23T16:11:27Z","snapshot_observed_at":"2026-08-13T21:57:18.514742Z","submitted_at":"2024-12-23T16:11:27Z","title":"Large Language Model Safety: A Holistic Survey","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T05:19:34.544425Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2412.17686"},"observation_digest":"sha256:b2658614e8c39567758bcdcf0bcd43ce190801e65e0e241a428fc3d389f4f4bb","observation_id":"3178df8e-113e-4b29-83db-0de3b2787764","resolution":{"observed_at":"2026-08-11T05:19:34.544425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-11T01:03:12.321630Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19037","last_updated":"2025-03-31T04:48:28Z","snapshot_observed_at":"2026-08-19T16:50:31.420611Z","submitted_at":"2024-12-26T03:13:03Z","title":"CL-Attack: Textual Backdoor Attacks via Cross-Lingual Triggers","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T01:03:12.321630Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2412.19037"},"observation_digest":"sha256:612cecc70a558f4a7874d83276e611d7542943add091baa5a588d3a9ace5e10c","observation_id":"cea33b91-912b-4498-b599-90468491ec88","resolution":{"observed_at":"2026-08-11T01:03:12.321630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-10T22:35:27.002467Z","title":"arXiv preprint arXiv:2310.02446","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.02018","last_updated":"2025-01-02T15:15:38Z","snapshot_observed_at":"2026-08-17T15:19:52.330628Z","submitted_at":"2025-01-02T15:15:38Z","title":"Safeguarding Large Language Models in Real-time with Tunable Safety-Performance Trade-offs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T22:35:27.002467Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2501.02018"},"observation_digest":"sha256:9366d9ee2634634005991307b23556068ea1f86a96293d30d4ee9b9fbac9cfc8","observation_id":"a76bef2b-afc8-45d7-b375-199041cb38a0","resolution":{"observed_at":"2026-08-10T22:35:27.002467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-10T20:35:52.877810Z","title":"Low-resource languages jailbreak gpt-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07959","last_updated":"2025-02-01T09:30:34Z","snapshot_observed_at":"2026-08-13T01:25:02.967809Z","submitted_at":"2025-01-14T09:23:30Z","title":"Self-Instruct Few-Shot Jailbreaking: Decompose the Attack into Pattern and Behavior Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:52.877810Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2501.07959"},"observation_digest":"sha256:c5f4eed6870f4ee29022f98029c23dd0b3ceddbe902b7b3169098dbfe7ee103b","observation_id":"e088c2cf-5dc4-4985-8771-c216233db363","resolution":{"observed_at":"2026-08-10T20:35:52.877810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-10T20:34:36.603073Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-15T11:29:32.348529Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.603073Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:7cf1466b1afaffc4e98d74a0841057a9127abcd64eeaf970cb18701ba3601f38","observation_id":"b95ecf7d-e00e-4012-a4b9-cbdb8aefe43f","resolution":{"observed_at":"2026-08-10T20:34:36.603073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-09T14:47:15.392539Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05209","last_updated":"2025-07-24T21:34:54Z","snapshot_observed_at":"2026-08-17T23:06:23.320593Z","submitted_at":"2025-02-03T18:59:16Z","title":"Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities","version":4},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-09T14:47:15.392539Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2502.05209"},"observation_digest":"sha256:aec24b51da798bf1f830d722debdc4f773bdfeebad3d13cf5347f69bb52c09b5","observation_id":"bc50e58e-37ee-492d-bc8c-52347c806179","resolution":{"observed_at":"2026-08-09T14:47:15.392539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-09T04:22:00.605573Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05223","last_updated":"2025-02-05T21:50:34Z","snapshot_observed_at":"2026-08-18T18:29:30.078158Z","submitted_at":"2025-02-05T21:50:34Z","title":"KDA: A Knowledge-Distilled Attacker for Generating Diverse Prompts to Jailbreak LLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T04:22:00.605573Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2502.05223"},"observation_digest":"sha256:df2cb51a7e8ca6b301dd143b0ac8cf85eb4188a19cd1d97555f803a2aaa23bee","observation_id":"c6ca5c90-bcec-4041-8a42-ba1e7e58f2ab","resolution":{"observed_at":"2026-08-09T04:22:00.605573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-08T04:58:34.959959Z","title":"Low-resource languages jailbreak gpt-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08489","last_updated":"2025-02-13T17:33:24Z","snapshot_observed_at":"2026-08-13T23:11:01.152432Z","submitted_at":"2025-02-12T15:26:08Z","title":"Salamandra Technical Report","version":2},"reference_index":213,"source":"pdf_text","source_observed_at":"2026-08-08T04:58:34.959959Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2502.08489"},"observation_digest":"sha256:f3ef24f3f602277c875a7c2f80f30197fb519171ca52878f6ce7d4891ccbc62a","observation_id":"0ef389d6-57e7-4057-a72b-6d2efaffec07","resolution":{"observed_at":"2026-08-08T04:58:34.959959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-07T21:10:57.781784Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09532","last_updated":"2025-02-13T17:49:30Z","snapshot_observed_at":"2026-08-16T00:28:13.491286Z","submitted_at":"2025-02-13T17:49:30Z","title":"Mind the Gap! Choice Independence in Using Multilingual LLMs for Persuasive Co-Writing Tasks in Different Languages","version":1},"reference_index":139,"source":"pdf_text","source_observed_at":"2026-08-07T21:10:57.781784Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2502.09532"},"observation_digest":"sha256:16e482577ead75c67d65fddb8a6abe804323e72db92a9f0d22d3914270492fd0","observation_id":"f1577663-4b9b-47da-b1c0-c60ae7821c06","resolution":{"observed_at":"2026-08-07T21:10:57.781784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-07T23:08:02.401728Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09674","last_updated":"2025-05-27T08:40:42Z","snapshot_observed_at":"2026-08-17T02:07:51.696583Z","submitted_at":"2025-02-13T06:39:22Z","title":"The Hidden Dimensions of LLM Alignment: A Multi-Dimensional Analysis of Orthogonal Safety Directions","version":4},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T23:08:02.401728Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2502.09674"},"observation_digest":"sha256:15f9e34096ff5efa437af0a7183a44ee94dcddc83eb5d43a64fe875f6911de32","observation_id":"ebe7a971-d1ae-4437-b7b3-138e698230a1","resolution":{"observed_at":"2026-08-07T23:08:02.401728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2503.02574","last_updated":"2026-05-18T17:54:05Z","snapshot_observed_at":"2026-08-18T01:04:38.795907Z","submitted_at":"2025-03-04T12:55:07Z","title":"LLM-Safety Evaluations Lack Robustness","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-23T01:26:45.402983Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2503.02574"},"observation_digest":"sha256:5381a58b8ee168f375b4324b46670a37b17be1d9f677fe7c449bb5c32f23bd89","observation_id":"730a3e3a-2ccb-4d8d-a0d3-d2bd2b570796","resolution":{"observed_at":"2026-05-23T01:27:21.257186Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-16T06:05:12.200545Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19093","last_updated":"2025-04-27T03:41:17Z","snapshot_observed_at":"2026-08-19T12:31:06.467988Z","submitted_at":"2025-04-27T03:41:17Z","title":"CipherBank: Exploring the Boundary of LLM Reasoning Capabilities through Cryptography Challenges","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T06:05:12.200545Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2504.19093"},"observation_digest":"sha256:3779ff563fe7227a9d62b4b15f76441799d0458eceb0a7246ea9f7b16cf2e6d3","observation_id":"1478c16c-eb79-4363-b9f9-85aeea398296","resolution":{"observed_at":"2026-08-16T06:05:12.200545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-16T05:57:58.376446Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19440","last_updated":"2025-04-28T03:01:51Z","snapshot_observed_at":"2026-08-20T07:16:03.686107Z","submitted_at":"2025-04-28T03:01:51Z","title":"JailbreaksOverTime: Detecting Jailbreak Attacks Under Distribution Shift","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T05:57:58.376446Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2504.19440"},"observation_digest":"sha256:77abac130c4e92d5dc37e36e420bbd1375dfa4658388ab3eefb5e20928628c22","observation_id":"6e3891d3-7c1f-479f-962c-e7801b07c097","resolution":{"observed_at":"2026-08-16T05:57:58.376446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-16T05:33:11.854124Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21053","last_updated":"2025-04-29T05:49:35Z","snapshot_observed_at":"2026-08-18T17:44:30.645968Z","submitted_at":"2025-04-29T05:49:35Z","title":"NeuRel-Attack: Neuron Relearning for Safety Disalignment in Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T05:33:11.854124Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2504.21053"},"observation_digest":"sha256:dc9330ffb286bf3a22b05742c851794100b67b60826285cab9e74f1a9a47eea6","observation_id":"9842d1c3-4b93-464b-aded-7334c802a1be","resolution":{"observed_at":"2026-08-16T05:33:11.854124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-15T23:39:22.213472Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04146","last_updated":"2025-05-07T05:54:04Z","snapshot_observed_at":"2026-08-21T09:43:30.592761Z","submitted_at":"2025-05-07T05:54:04Z","title":"Unmasking the Canvas: A Dynamic Benchmark for Image Generation Jailbreaking and LLM Content Safety","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T23:39:22.213472Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2505.04146"},"observation_digest":"sha256:fd312181cf85a94b64a549e04395140f6eb29000b655eb62e05a068a6d6308d3","observation_id":"2d7480d4-067b-49c8-a9d8-bc8226d1286f","resolution":{"observed_at":"2026-08-15T23:39:22.213472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-15T20:34:34.526897Z","title":"Low-resource Languages Jailbreak GPT-4,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12567","last_updated":"2025-05-18T22:55:16Z","snapshot_observed_at":"2026-08-18T18:57:05.261771Z","submitted_at":"2025-05-18T22:55:16Z","title":"A Survey of Attacks on Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T20:34:34.526897Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2505.12567"},"observation_digest":"sha256:b6ddf75c96b89fa0288efaaf15a55e766b22fc9b45d46eacc8ff181763e70014","observation_id":"cc920407-b97d-4470-b445-96c8b683fbf3","resolution":{"observed_at":"2026-08-15T20:34:34.526897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-15T20:36:57.255813Z","title":"Y ong, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17066","last_updated":"2025-08-11T12:32:14Z","snapshot_observed_at":"2026-08-21T03:49:14.442911Z","submitted_at":"2025-05-18T16:13:07Z","title":"Improving LLM Outputs Against Jailbreak Attacks with Expert Model Integration","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:36:57.255813Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2505.17066"},"observation_digest":"sha256:ffa376dc56dbcec693a4cafc571b7e7f876e835476d8f040014828790048c0c4","observation_id":"b9de7364-2f94-42ad-9a4c-27242dac9181","resolution":{"observed_at":"2026-08-15T20:36:57.255813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-07T14:52:16.928485Z","title":"Low-resource languages jailbreak gpt-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18212","last_updated":"2025-05-22T22:06:09Z","snapshot_observed_at":"2026-08-13T01:25:59.957395Z","submitted_at":"2025-05-22T22:06:09Z","title":"Towards medical AI misalignment: a preliminary study","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:52:16.928485Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2505.18212"},"observation_digest":"sha256:b35d21f9360ba0bba3c68745635818912c71ec9e95fb014c7b2c763683fa2498","observation_id":"93bf1d20-5cec-4421-a34e-59cce3628d5e","resolution":{"observed_at":"2026-08-07T14:52:16.928485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-07T14:27:06.090288Z","title":"Low-resource languages jailbreak gpt-4,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-21T23:02:11.556784Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.090288Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:9ac0ab02f5c62a8d10542719ed82aed60c3cb4b40647f4fa498af05817e3cc81","observation_id":"87021e4c-06e4-467e-89ff-3457213ba352","resolution":{"observed_at":"2026-08-07T14:27:06.090288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-07T13:58:20.347882Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20546","last_updated":"2025-05-28T02:10:37Z","snapshot_observed_at":"2026-08-13T18:59:35.915575Z","submitted_at":"2025-05-26T22:20:45Z","title":"Paths Not Taken: Understanding and Mending the Multilingual Factual Recall Pipeline","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T13:58:20.347882Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2505.20546"},"observation_digest":"sha256:c8b94bf376692c2e71e211a3ba7c322c4021a9f1cc8fd48e7badf01c00b86d58","observation_id":"cd2759c2-ef6a-4d2e-82df-7b5953be472a","resolution":{"observed_at":"2026-08-07T13:58:20.347882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-07T13:53:40.616522Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20841","last_updated":"2025-08-18T05:58:10Z","snapshot_observed_at":"2026-08-21T09:27:21.597711Z","submitted_at":"2025-05-27T07:59:56Z","title":"Concealment of Intent: A Game-Theoretic Analysis","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:53:40.616522Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2505.20841"},"observation_digest":"sha256:59b53460e99788a2219388f8ebd6c0eadc316714b4016d6ffafaa991a4ba25ed","observation_id":"3b49342b-9290-4a62-9060-ceded0969286","resolution":{"observed_at":"2026-08-07T13:53:40.616522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-07T13:31:01.404747Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21664","last_updated":"2025-05-27T18:44:30Z","snapshot_observed_at":"2026-08-14T23:05:27.380787Z","submitted_at":"2025-05-27T18:44:30Z","title":"Expert Survey: AI Reliability & Security Research Priorities","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:31:01.404747Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2505.21664"},"observation_digest":"sha256:ad235d0ef2f7fed178b37fc21bf8bfa8ea884f2fe424abb19b73a098a1d01da3","observation_id":"9aaf56e4-1414-4bb6-8438-5260f479e868","resolution":{"observed_at":"2026-08-07T13:31:01.404747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-07T13:15:35.430375Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22293","last_updated":"2025-05-28T12:29:05Z","snapshot_observed_at":"2026-08-16T13:33:53.024664Z","submitted_at":"2025-05-28T12:29:05Z","title":"Compensating for Data with Reasoning: Low-Resource Machine Translation with LLMs","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:35.430375Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2505.22293"},"observation_digest":"sha256:faca264e8a51b081d821702ed24c873b1c00d240d9e076d5a06c7d00591d3060","observation_id":"9a1dcd97-7d57-4a48-907f-8b3489064b64","resolution":{"observed_at":"2026-08-07T13:15:35.430375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-07T04:37:08.222926Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10236","last_updated":"2025-08-14T05:03:53Z","snapshot_observed_at":"2026-08-20T06:30:05.503631Z","submitted_at":"2025-06-11T23:36:30Z","title":"Prompt Attacks Reveal Superficial Knowledge Removal in Unlearning Methods","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:37:08.222926Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2506.10236"},"observation_digest":"sha256:04e0db74f235f56239826607e6b058f14b324b0a457f8582444aca8d61aaa44f","observation_id":"e7b22fde-4c56-45b1-8e2e-19c8d5f09556","resolution":{"observed_at":"2026-08-07T04:37:08.222926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-06T23:42:42.798103Z","title":"arXiv preprint arXiv:2310.02446 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16760","last_updated":"2025-06-20T05:30:25Z","snapshot_observed_at":"2026-08-16T05:04:37.983185Z","submitted_at":"2025-06-20T05:30:25Z","title":"Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:42:42.798103Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2506.16760"},"observation_digest":"sha256:e8214ef0221bef48a734d927770150989455f1fecfcbb819aebd96b90bb2a06c","observation_id":"feee3bb0-1f51-4cd0-a73d-c45e8e78c78d","resolution":{"observed_at":"2026-08-06T23:42:42.798103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-06T21:29:48.997312Z","title":"and Bach, S.H., 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23958","last_updated":"2025-06-30T15:25:58Z","snapshot_observed_at":"2026-08-17T23:13:43.335861Z","submitted_at":"2025-06-30T15:25:58Z","title":"Bridging the Gap with Retrieval-Augmented Generation: Making Prosthetic Device User Manuals Available in Marginalised Languages","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:29:48.997312Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2506.23958"},"observation_digest":"sha256:916cfb25cdd3c4c270a3bbbdd00a96b80a6a57b8abdc7462e45cae1a419687d2","observation_id":"cfe6234d-f633-4e9d-966c-6efa0979c478","resolution":{"observed_at":"2026-08-06T21:29:48.997312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-06T21:05:19.158580Z","title":"Low-resource languages jailbreak gpt-4.arXiv preprint arXiv:2310.02446, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02990","last_updated":"2025-07-01T18:00:04Z","snapshot_observed_at":"2026-08-08T08:11:38.202399Z","submitted_at":"2025-07-01T18:00:04Z","title":"`For Argument's Sake, Show Me How to Harm Myself!': Jailbreaking LLMs in Suicide and Self-Harm Contexts","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:05:19.158580Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2507.02990"},"observation_digest":"sha256:aca18c17b220dc40456ad8c345684e18ec443bdce047fa5997e6f356ffee9ae8","observation_id":"b3527ed0-15e6-4f3d-802b-ac57da5f1cef","resolution":{"observed_at":"2026-08-06T21:05:19.158580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-06T20:14:26.634219Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03473","last_updated":"2025-07-04T10:54:04Z","snapshot_observed_at":"2026-08-16T10:36:23.150585Z","submitted_at":"2025-07-04T10:54:04Z","title":"Beyond Weaponization: NLP Security for Medium and Lower-Resourced Languages in Their Own Right","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T20:14:26.634219Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2507.03473"},"observation_digest":"sha256:df3010e86520a802e30c0324ab4a9969073202abbfc298e1299af1ed1f691fe9","observation_id":"6df9012a-c4cd-4d40-a6a2-5ea86222a8c9","resolution":{"observed_at":"2026-08-06T20:14:26.634219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-06T19:54:11.798190Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.04365","last_updated":"2025-07-06T12:19:04Z","snapshot_observed_at":"2026-08-17T13:01:45.645924Z","submitted_at":"2025-07-06T12:19:04Z","title":"Attention Slipping: A Mechanistic Understanding of Jailbreak Attacks and Defenses in LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:54:11.798190Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2507.04365"},"observation_digest":"sha256:8de69148f2324744a93a057dbb14068df06ee7d918649b6b32944fef2f2d9165","observation_id":"e392ee3c-fb5c-481c-9615-e62c0bd6c656","resolution":{"observed_at":"2026-08-06T19:54:11.798190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-06T19:18:46.549467Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06043","last_updated":"2025-08-06T05:32:54Z","snapshot_observed_at":"2026-08-17T04:16:33.413483Z","submitted_at":"2025-07-08T14:45:21Z","title":"CAVGAN: Unifying Jailbreak and Defense of LLMs via Generative Adversarial Attacks on their Internal Representations","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T19:18:46.549467Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2507.06043"},"observation_digest":"sha256:6eac4a3c79bdf7ce440ae5cb248055b5e3382435f41789bef3aeed8b83bf5c67","observation_id":"70640b84-e213-4601-b2c0-aa0b955aa74c","resolution":{"observed_at":"2026-08-06T19:18:46.549467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-06T19:26:13.755908Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08020","last_updated":"2025-07-08T03:01:00Z","snapshot_observed_at":"2026-08-16T11:53:02.284922Z","submitted_at":"2025-07-08T03:01:00Z","title":"Circumventing Safety Alignment in Large Language Models Through Embedding Space Toxicity Attenuation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:26:13.755908Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2507.08020"},"observation_digest":"sha256:89f0ecdc8c4da45c1b1a5e5f97188340c24b00fe123768f335e9d604a960b409","observation_id":"f7ee0b76-e1ea-426c-b837-ad7777a81516","resolution":{"observed_at":"2026-08-06T19:26:13.755908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-06T18:28:46.143521Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08898","last_updated":"2025-07-17T08:01:44Z","snapshot_observed_at":"2026-08-20T22:33:18.638159Z","submitted_at":"2025-07-11T05:15:35Z","title":"SEALGuard: Safeguarding the Multilingual Conversations in Southeast Asian Languages for LLM Software Systems","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:28:46.143521Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2507.08898"},"observation_digest":"sha256:85efc28ebd85c84d8af1734577c919f11e2c5954ae08bf09048a33e864fcd5bf","observation_id":"ddf51fb8-ea69-4843-b656-286c1056e48d","resolution":{"observed_at":"2026-08-06T18:28:46.143521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-06T17:35:48.582594Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14202","last_updated":"2025-07-14T17:41:12Z","snapshot_observed_at":"2026-08-22T02:31:42.670661Z","submitted_at":"2025-07-14T17:41:12Z","title":"PRM-Free Security Alignment of Large Models via Red Teaming and Adversarial Training","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-06T17:35:48.582594Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2507.14202"},"observation_digest":"sha256:67cc0751ccbab639b0535e118c7938cdcd77505d94c45f7f0e0e73de22a29aeb","observation_id":"015af25f-f1e0-4a56-bfe7-fea6ed1beb49","resolution":{"observed_at":"2026-08-06T17:35:48.582594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T20:31:38.034933Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10404","last_updated":"2025-08-14T07:12:44Z","snapshot_observed_at":"2026-08-21T08:08:18.531548Z","submitted_at":"2025-08-14T07:12:44Z","title":"Layer-Wise Perturbations via Sparse Autoencoders for Adversarial Text Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:38.034933Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2508.10404"},"observation_digest":"sha256:9df4a7e42767490dc1fcb10f4edb2cb4a2a6246f827d82b276b6cd504aacd3dd","observation_id":"fd092592-9b9a-45b2-b9c7-b628184385d1","resolution":{"observed_at":"2026-08-05T20:31:38.034933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T16:00:52.265295Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19445","last_updated":"2026-06-16T17:34:06Z","snapshot_observed_at":"2026-08-08T05:25:02.825611Z","submitted_at":"2025-08-26T21:36:45Z","title":"On Surjectivity of Neural Networks: Can you elicit any behavior from your model?","version":3},"reference_index":109,"source":"arxiv_source","source_observed_at":"2026-08-05T16:00:52.265295Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2508.19445"},"observation_digest":"sha256:56dafce282b3aa39e48ddea90398f0b5e25fb2cc7a662c66849fa1e908c02bca","observation_id":"ea933e5c-774d-4f3e-af84-07d901cd2ee6","resolution":{"observed_at":"2026-08-05T16:00:52.265295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T14:51:03.803021Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20848","last_updated":"2025-08-28T14:40:27Z","snapshot_observed_at":"2026-08-20T22:43:25.873807Z","submitted_at":"2025-08-28T14:40:27Z","title":"JADES: A Universal Framework for Jailbreak Assessment via Decompositional Scoring","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T14:51:03.803021Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2508.20848"},"observation_digest":"sha256:d0698b44dd289cb15b5d97367619d3f44e1dcedfaf80b00709c28fd5a61dfb23","observation_id":"a0678564-32d8-4534-93d4-5716c60d3a32","resolution":{"observed_at":"2026-08-05T14:51:03.803021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-15T16:25:35.748405Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08000","last_updated":"2025-09-06T16:03:07Z","snapshot_observed_at":"2026-08-19T11:41:25.041979Z","submitted_at":"2025-09-06T16:03:07Z","title":"AntiDote: Bi-level Adversarial Training for Tamper-Resistant LLMs","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-15T16:25:35.748405Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2509.08000"},"observation_digest":"sha256:fb482c95df738b7a994b240c8baba58943d849286f99feb6bae760a720b42469","observation_id":"a969486c-572c-44f7-aaab-60fbad43883b","resolution":{"observed_at":"2026-08-15T16:25:35.748405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-04T09:25:58.150266Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.15476","last_updated":"2026-07-04T04:20:15Z","snapshot_observed_at":"2026-08-14T22:20:04.981358Z","submitted_at":"2025-10-17T09:38:54Z","title":"SoK: Systematizing LLM Prompt Security: Taxonomies, Datasets, and Unified Evaluation of Attacks and Defenses","version":3},"reference_index":219,"source":"pdf_text","source_observed_at":"2026-08-04T09:25:58.150266Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2510.15476"},"observation_digest":"sha256:d3ae0883eb7ed14369252ba8c44430306b2d93b9c2ed05d831e8163d4d385f50","observation_id":"a3a9ec3b-aa08-4e34-92ef-7fe2bdb95827","resolution":{"observed_at":"2026-08-04T09:25:58.150266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2511.02356","last_updated":"2026-04-20T12:25:45Z","snapshot_observed_at":"2026-08-15T04:39:07.087594Z","submitted_at":"2025-11-04T08:24:22Z","title":"ASTRA: An Automated Framework for Strategy Discovery, Retrieval, and Evolution for Jailbreaking LLMs","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-18T01:54:22.995178Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2511.02356"},"observation_digest":"sha256:5d7d66f681748f6363a2c84084d5d083ea6d3183df0b8b294c234098a8425289","observation_id":"557b2729-488e-4a06-986c-0e27793bd88f","resolution":{"observed_at":"2026-05-18T01:55:37.975623Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2604.01473","last_updated":"2026-05-28T05:44:14Z","snapshot_observed_at":"2026-08-15T03:04:08.722858Z","submitted_at":"2026-04-01T23:29:12Z","title":"SelfGrader: LLM Jailbreak Detection via Anchored Token-Level Logits","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T21:43:46.728512Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2604.01473"},"observation_digest":"sha256:4ac765ff16ce70c07c302fc068d10123e84bfee01b7aafd78854b859cc79d474","observation_id":"0a168ba9-4614-456a-b49b-c1513d2e07a0","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2604.12232","last_updated":"2026-04-14T03:12:19Z","snapshot_observed_at":"2026-08-14T14:59:30.287265Z","submitted_at":"2026-04-14T03:12:19Z","title":"TEMPLATEFUZZ: Fine-Grained Chat Template Fuzzing for Jailbreaking and Red Teaming LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T16:02:52.006859Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2604.12232"},"observation_digest":"sha256:28f5816fd0a5536395d1daf1a4348fff3d21f9bc2f704e576a87f46a84fecf7d","observation_id":"e9833494-62af-4690-86b2-ec0dcd530029","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2604.12710","last_updated":"2026-04-23T04:47:08Z","snapshot_observed_at":"2026-08-17T09:19:59.852518Z","submitted_at":"2026-04-13T15:59:50Z","title":"LASA: Language-Agnostic Semantic Alignment at the Semantic Bottleneck for LLM Safety","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T15:02:57.349931Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2604.12710"},"observation_digest":"sha256:4d0cedff3ecfd53f61a943a521b7d4479472d67718faee8a60eecb4196091edc","observation_id":"e075710c-92a5-4d79-8e88-d7f33173d648","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2604.20720","last_updated":"2026-04-22T16:07:10Z","snapshot_observed_at":"2026-08-19T13:16:02.834892Z","submitted_at":"2026-04-22T16:07:10Z","title":"COMPASS: COntinual Multilingual PEFT with Adaptive Semantic Sampling","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-10T01:14:16.831333Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2604.20720"},"observation_digest":"sha256:aa3acc9766505103a657915f06c3eefa95818b87ce986553f37aa0fe90d45b40","observation_id":"6c23ba0a-308f-48a1-9558-2eea7772ee62","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2604.22427","last_updated":"2026-04-24T10:38:40Z","snapshot_observed_at":"2026-08-12T23:46:46.574912Z","submitted_at":"2026-04-24T10:38:40Z","title":"Automation-Exploit: A Multi-Agent LLM Framework for Adaptive Offensive Security with Digital Twin-Based Risk-Mitigated Exploitation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-08T11:45:21.608035Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2604.22427"},"observation_digest":"sha256:9e7f3eb766f799bd954b94e860000eeb1d06a2c0aa7209a835bfb5f41e07cb48","observation_id":"7ee8a589-60cd-426c-bbe5-c1aace63aa1b","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2605.00236","last_updated":"2026-04-30T21:15:38Z","snapshot_observed_at":"2026-08-11T08:40:01.863341Z","submitted_at":"2026-04-30T21:15:38Z","title":"Attention Is Where You Attack","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T19:54:41.445447Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2605.00236"},"observation_digest":"sha256:1e0eb6e6afa27a0d95f7817289fc5bb2911d1e4d7bf930bec04415dcce81ffd9","observation_id":"1a14223e-619f-4373-9e0e-8f1d3e813f72","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2605.01034","last_updated":"2026-05-01T18:59:24Z","snapshot_observed_at":"2026-08-15T23:24:42.078556Z","submitted_at":"2026-05-01T18:59:24Z","title":"A Theoretical Game of Attacks via Compositional Skills","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-09T19:07:13.287966Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2605.01034"},"observation_digest":"sha256:7bb2e6d0400f5288b21abdc0fad3e16cbf6c71d3e927eaaf77df5a1f328b0406","observation_id":"1e51af16-11b0-450e-93af-2e7b0e919c8b","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2605.02971","last_updated":"2026-05-07T19:25:15Z","snapshot_observed_at":"2026-08-15T02:39:50.203824Z","submitted_at":"2026-05-03T14:22:49Z","title":"Multilingual Safety Alignment via Self-Distillation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-08T19:35:56.059362Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2605.02971"},"observation_digest":"sha256:a433abab70523e45128f52d098cb5be68f3409885f66a2771f4565349cb11213","observation_id":"db57c284-d282-44e8-8613-4e3b15a9fb7e","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2605.02971","last_updated":"2026-05-07T19:25:15Z","snapshot_observed_at":"2026-08-15T02:39:50.203824Z","submitted_at":"2026-05-03T14:22:49Z","title":"Multilingual Safety Alignment via Self-Distillation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-11T01:08:32.264867Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2605.02971"},"observation_digest":"sha256:78e67f5af84ab51876c40d4a09b5c5e4297c63e51543ad92d502961992d2cc0f","observation_id":"3b739871-9309-4df5-80c6-7e6a5f004c0d","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2605.04019","last_updated":"2026-05-05T17:43:52Z","snapshot_observed_at":"2026-08-14T01:28:50.207494Z","submitted_at":"2026-05-05T17:43:52Z","title":"Redefining AI Red Teaming in the Agentic Era: From Weeks to Hours","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-07T16:06:18.057868Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2605.04019"},"observation_digest":"sha256:0144e083991ae05db49f6aa9ae308974ff7a3737b7f4b9db6fc680a6004838d9","observation_id":"1d09e206-3ed3-49f3-b659-baae2f5652be","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2605.05630","last_updated":"2026-05-12T16:52:21Z","snapshot_observed_at":"2026-08-18T01:39:32.864358Z","submitted_at":"2026-05-07T03:35:31Z","title":"One Turn Too Late: Response-Aware Defense Against Hidden Malicious Intent in Multi-Turn Dialogue","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-08T11:17:19.079380Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2605.05630"},"observation_digest":"sha256:03f34102215c19be7d41845e2b569c058763d60109aa2cd82826e866305a1a8d","observation_id":"88731c6b-a13a-4b79-bd28-2d68ae420da2","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2605.05630","last_updated":"2026-05-12T16:52:21Z","snapshot_observed_at":"2026-08-18T01:39:32.864358Z","submitted_at":"2026-05-07T03:35:31Z","title":"One Turn Too Late: Response-Aware Defense Against Hidden Malicious Intent in Multi-Turn Dialogue","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T07:53:06.928500Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2605.05630"},"observation_digest":"sha256:ac3c6b4073e039068e1e395715c6f9c1bfc56e1d31ec7de09ac60f4febf21c34","observation_id":"b6d226c8-474d-485d-90d1-cdd3e69bc946","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2605.10998","last_updated":"2026-05-09T15:52:29Z","snapshot_observed_at":"2026-08-16T01:20:22.375207Z","submitted_at":"2026-05-09T15:52:29Z","title":"Few-Shot Truly Benign DPO Attack for Jailbreaking LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-13T07:06:46.387088Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2605.10998"},"observation_digest":"sha256:48fc69367c41a84a23971f4e928ee6c14731777271f2807e72252cbdfe32b6e3","observation_id":"a30bdb1c-f63e-4508-bb95-f4f20759d76c","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2605.12876","last_updated":"2026-05-13T01:44:31Z","snapshot_observed_at":"2026-08-16T02:51:53.723861Z","submitted_at":"2026-05-13T01:44:31Z","title":"Certified Robustness under Heterogeneous Perturbations via Hybrid Randomized Smoothing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-14T20:23:24.004872Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2605.12876"},"observation_digest":"sha256:99230611ed6fc55e8e9d439a25c6d1457e5b36e874e6b386fc48f0af89214925","observation_id":"e5133c3d-5357-48e3-98d0-2801510da929","resolution":{"observed_at":"2026-05-17T09:24:14.203470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2605.16471","last_updated":"2026-05-15T13:53:02Z","snapshot_observed_at":"2026-08-14T00:09:46.311940Z","submitted_at":"2026-05-15T13:53:02Z","title":"From AI-Generated Content to Agentic Action: Security and Safety Threats in Generative AI","version":1},"reference_index":149,"source":"pdf_text","source_observed_at":"2026-05-20T18:08:24.901025Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2605.16471"},"observation_digest":"sha256:09cac3ce8d09ccd46a4b5c60e843658ebfafc98ee86bf6f987bdcd1fe609edef","observation_id":"64eb1c64-7824-44ed-895b-90e5aa7615e0","resolution":{"observed_at":"2026-05-20T18:08:50.503214Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2605.18239","last_updated":"2026-05-18T11:33:18Z","snapshot_observed_at":"2026-08-16T11:34:52.429163Z","submitted_at":"2026-05-18T11:33:18Z","title":"Multilingual jailbreaking of LLMs using low-resource languages","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2605.18239"},"observation_digest":"sha256:b2c7e1e3b461ed13e85948406115fd6ee0940c1b0ce47a9e44c0eec44581d0d6","observation_id":"81ed05c5-27fb-4e8e-8bcf-36d042269f9b","resolution":{"observed_at":"2026-05-20T10:33:12.153016Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2605.21362","last_updated":"2026-05-20T16:27:00Z","snapshot_observed_at":"2026-08-17T16:09:34.303359Z","submitted_at":"2026-05-20T16:27:00Z","title":"LASH: Adaptive Semantic Hybridization for Black-Box Jailbreaking of Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-21T04:48:19.926845Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2605.21362"},"observation_digest":"sha256:6bc9c0f0949a9bd8b2f1bdd9040631be1ddd884dc516832852baa84302d075a0","observation_id":"5f91e606-6411-494d-b76b-97e309ba57d0","resolution":{"observed_at":"2026-05-21T04:49:35.465825Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2605.25420","last_updated":"2026-08-13T19:18:23Z","snapshot_observed_at":"2026-08-19T23:09:18.177132Z","submitted_at":"2026-05-25T04:45:44Z","title":"SomaliBench Eval: Measuring English-to-Somali Refusal Gaps in Open-Weight Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T22:33:37.250679Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2605.25420"},"observation_digest":"sha256:04b7e8262629b82d3dcc083e725ac0975dfb5ad88520d6e4bfe97e33686b1b19","observation_id":"3c8e8c2d-22da-4878-818e-c73a971c8684","resolution":{"observed_at":"2026-06-29T22:34:01.325996Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2605.29237","last_updated":"2026-08-15T00:47:06Z","snapshot_observed_at":"2026-08-20T23:09:35.455970Z","submitted_at":"2026-05-28T01:53:14Z","title":"Evolving Skill-Structured Attack Memory Enhances LLM Jailbreaking","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T07:10:50.007951Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2605.29237"},"observation_digest":"sha256:77441e08466dca13619394e9507c4dc440aab4368e71ab65e211e104ce7f0611","observation_id":"d4844bf5-f01b-4adb-acfa-fe29f720b1a3","resolution":{"observed_at":"2026-06-29T07:13:16.290123Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2606.01196","last_updated":"2026-05-31T12:19:40Z","snapshot_observed_at":"2026-07-06T23:41:48.357871Z","submitted_at":"2026-05-31T12:19:40Z","title":"Low-Resource Safety Failures Are Action Failures, Not Representation Failures","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-28T16:59:51.969896Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2606.01196"},"observation_digest":"sha256:665516bd96590a8e092bf7d61786dcccbacc85985b52f1b4a3361654edf8dd55","observation_id":"f0e5f82d-8fb4-4c90-945d-3324333f93d9","resolution":{"observed_at":"2026-06-28T17:02:24.050953Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2606.01204","last_updated":"2026-05-31T12:39:05Z","snapshot_observed_at":"2026-08-16T08:10:38.204669Z","submitted_at":"2026-05-31T12:39:05Z","title":"Implicit Geographic Inference in LLM Medical Triage: Language-Driven Disparities in Emergency Recommendations","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-28T16:56:53.975854Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2606.01204"},"observation_digest":"sha256:9f5ba3d09e663d730951b14800d7cc262a5ba24423ce79bf6d38cf710231e485","observation_id":"851b7c7a-e4ef-49d9-8c90-c4f5eb351590","resolution":{"observed_at":"2026-06-28T17:02:24.386957Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2606.04778","last_updated":"2026-06-03T12:01:27Z","snapshot_observed_at":"2026-08-15T10:42:40.060569Z","submitted_at":"2026-06-03T12:01:27Z","title":"Inference-Time Vulnerability Beyond Shallow Safety: Alignment Along Generation Trajectories","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T06:05:57.528433Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2606.04778"},"observation_digest":"sha256:bdd8649f6dfec7442e8683c5c687e865b3fad1052d1c77273bf0231d8ee1da39","observation_id":"9d2e5706-ef58-49f8-8c6a-a8215af88a7d","resolution":{"observed_at":"2026-07-02T08:26:47.879196Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2606.05523","last_updated":"2026-06-04T00:06:13Z","snapshot_observed_at":"2026-08-08T00:57:41.523461Z","submitted_at":"2026-06-04T00:06:13Z","title":"CHASE: Adversarial Red-Blue Teaming for Improving LLM Safety using Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-28T02:34:26.334078Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2606.05523"},"observation_digest":"sha256:35b18e714b0ab1d3a2d5054dbca9866d446eea0bbcb8875cb13cc1292b512598","observation_id":"876a4ca2-4fe7-4d9b-9814-3d24ef178c63","resolution":{"observed_at":"2026-07-02T12:06:55.641922Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2606.05609","last_updated":"2026-06-04T02:31:29Z","snapshot_observed_at":"2026-08-05T14:48:48.513078Z","submitted_at":"2026-06-04T02:31:29Z","title":"SlotGCG: Exploiting the Positional Vulnerability in LLMs for Jailbreak Attacks","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-28T01:16:07.252429Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2606.05609"},"observation_digest":"sha256:f3b813eae95f6d3dfd29d79925f7772cb8a018795c29a7de02ad9a302a4be74c","observation_id":"0ca34582-8e8d-4677-8e07-024afe7f940c","resolution":{"observed_at":"2026-07-02T13:26:59.338990Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2606.07335","last_updated":"2026-06-05T14:49:26Z","snapshot_observed_at":"2026-07-06T23:47:00.425715Z","submitted_at":"2026-06-05T14:49:26Z","title":"Defending Jailbreak Attacks on Large Language Models via Manifold Trajectory Kinetics","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-27T21:55:48.561400Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2606.07335"},"observation_digest":"sha256:56234f29a5b036139bdc1aef6e5824e337938ada334c1a3bf1a6a461d43e5d26","observation_id":"3dde908f-93b3-4a35-86e7-dcaa763179da","resolution":{"observed_at":"2026-07-02T17:37:14.905991Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2606.07874","last_updated":"2026-06-05T22:11:26Z","snapshot_observed_at":"2026-08-02T07:02:54.289200Z","submitted_at":"2026-06-05T22:11:26Z","title":"Safety is Contextual, LLM-Judges Are Not: Navigating the Rigid Priors of Evaluators","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-27T21:39:26.268337Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2606.07874"},"observation_digest":"sha256:6b0ca5743ac2384d4cc7bba02582445f9d1858d7911ddb461a49e4f15e0ddf90","observation_id":"30fbb572-a222-46f2-bcf6-90395448acc2","resolution":{"observed_at":"2026-06-27T21:41:18.502143Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2606.09178","last_updated":"2026-06-22T07:46:06Z","snapshot_observed_at":"2026-08-16T21:32:30.596973Z","submitted_at":"2026-06-08T08:17:18Z","title":"Culturally-Adapted Red-Teaming Across East and Southeast Asian Contexts: A Methodological and Comparative Analysis","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T16:48:54.802860Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2606.09178"},"observation_digest":"sha256:68bd66731a13fc31b216a250b32cbfec383a4c348732505d636752d489fbee8d","observation_id":"869b28d2-4ea0-40a9-b7e0-ca0b14518301","resolution":{"observed_at":"2026-07-03T01:07:30.331495Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2606.11817","last_updated":"2026-06-10T08:50:59Z","snapshot_observed_at":"2026-08-14T12:18:10.317869Z","submitted_at":"2026-06-10T08:50:59Z","title":"Grammar-Constrained Decoding Can Jailbreak LLMs into Generating Malicious Code","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-27T09:14:50.233629Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2606.11817"},"observation_digest":"sha256:1f869d8fe97fb53d10ed187295c8ef0aa7a3901bb93109405c2f6eee72688934","observation_id":"3c35fb39-c1c1-4144-8e43-6bb0965f3bf2","resolution":{"observed_at":"2026-07-03T11:58:06.191553Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2606.24388","last_updated":"2026-06-23T10:20:40Z","snapshot_observed_at":"2026-07-06T23:58:58.854077Z","submitted_at":"2026-06-23T10:20:40Z","title":"PHANTOM: A Large-Scale Dataset of Multimodal Adversarial Attacks for Vision-Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-25T23:52:02.327522Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2606.24388"},"observation_digest":"sha256:504b8dd233d3d22dfa6765381d00a6702822e14f7df1bb158352b48bd5866b95","observation_id":"87300ae7-8f77-4c6c-9b13-c244b35237bf","resolution":{"observed_at":"2026-07-04T17:09:59.495564Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2606.25476","last_updated":"2026-07-21T11:09:35Z","snapshot_observed_at":"2026-08-17T21:27:27.694063Z","submitted_at":"2026-06-24T07:00:53Z","title":"A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-25T20:58:53.119386Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2606.25476"},"observation_digest":"sha256:62283beff71615ab35c509d1ca92bf2f55c0103548e62700121005989eb47bda","observation_id":"ae8e0d9e-e5ae-4280-8be1-391f641c46f5","resolution":{"observed_at":"2026-07-04T19:50:11.071589Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-02T10:16:38.577010Z","title":"arXiv preprint arXiv:2310.02446 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.25476","last_updated":"2026-07-21T11:09:35Z","snapshot_observed_at":"2026-08-17T21:27:27.694063Z","submitted_at":"2026-06-24T07:00:53Z","title":"A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T10:16:38.577010Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2606.25476"},"observation_digest":"sha256:7bc0e978872c69b56a9f3c83f65f7a3f0442bc511e1bade36ae276273b03adb9","observation_id":"4b18ef6e-a960-4f42-ad66-af71683a75e7","resolution":{"observed_at":"2026-08-02T10:16:38.577010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":"2310.02446","doi":"10.48550/arxiv.2310.02446","metadata_source":"pith","pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Low-Resource Languages Jailbreak GPT-4","venue":"cs.CL","work_id":"e88f3256-3186-452b-ba46-58885055c4ec","year":2023},"citing_paper":{"arxiv_id":"2607.07461","last_updated":"2026-07-08T14:29:23Z","snapshot_observed_at":"2026-08-15T01:33:12.143322Z","submitted_at":"2026-07-08T14:29:23Z","title":"Mitigating Taint-Style Vulnerabilities in MCP Servers via Security-Aware Tool Descriptions","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-09T10:22:23.782469Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2607.07461"},"observation_digest":"sha256:4df82e397307bc5064fca1b8ead1609ffda0005dd0d36747cfc1dfced747e021","observation_id":"b8b7a5d9-06d6-497d-ac9b-cd082d2e9672","resolution":{"observed_at":"2026-07-09T10:26:11.124368Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-01T18:33:08.006467Z","title":"Low-resource languages jailbreak GPT-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17270","last_updated":"2026-07-19T14:20:31Z","snapshot_observed_at":"2026-08-21T15:07:49.298972Z","submitted_at":"2026-07-19T14:20:31Z","title":"Safety That Does Not Transfer: Cross-Lingual Clinical Correctness Drift in Deployable Medical Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T18:33:08.006467Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2607.17270"},"observation_digest":"sha256:432270be23cdf34d06596e53ff3a37c2e9691041c7e36198df6b0088a494acef","observation_id":"22beb086-42d9-4e21-83f2-1bb05cbe5467","resolution":{"observed_at":"2026-08-01T18:33:08.006467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-01T08:38:56.164741Z","title":", title=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21063","last_updated":"2026-07-23T08:56:11Z","snapshot_observed_at":"2026-08-07T01:50:19.863208Z","submitted_at":"2026-07-23T08:56:11Z","title":"QuantiBias: Benchmarking Quantization-Induced Bias in LLMs","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T08:38:56.164741Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2607.21063"},"observation_digest":"sha256:522af66bd0b8f84d107c086107a1e5bf968bb817506bf49276b32b189b004ceb","observation_id":"4b4f6118-97a6-4bab-b21e-601db75eb50f","resolution":{"observed_at":"2026-08-01T08:38:56.164741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-01T02:40:45.091898Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25375","last_updated":"2026-07-28T07:30:12Z","snapshot_observed_at":"2026-08-16T13:26:38.164221Z","submitted_at":"2026-07-28T07:30:12Z","title":"Inspect India Evals: An Open Benchmarking Framework for Evaluating Large Language Models in the Indian Linguistic and Cultural Context","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T02:40:45.091898Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2607.25375"},"observation_digest":"sha256:bfd215e469e0820205d6b0eefe52a6f208520f03958b3a36ce923fe240722280","observation_id":"8e123e44-bafe-4111-ac4e-b8a13c14c091","resolution":{"observed_at":"2026-08-01T02:40:45.091898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-06T00:14:01.267746Z","title":"Yong, Z.-X., Menghini, C., & Bach, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01436","last_updated":"2026-08-02T18:37:44Z","snapshot_observed_at":"2026-08-15T08:28:04.510549Z","submitted_at":"2026-08-02T18:37:44Z","title":"Same violence, different answer: how AI responds to coercive control against women across languages","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T00:14:01.267746Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2608.01436"},"observation_digest":"sha256:bee81f9127b559392d3da60a043e75082073469edd7eaaebe247436c92824228","observation_id":"da228762-a317-4082-a49b-946363d9df69","resolution":{"observed_at":"2026-08-06T00:14:01.267746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T00:48:49.383630Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T18:08:52.787563Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:49.383630Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:7a2b507b5dbc8dd8854a1c440844e14d98ce247b66c414d77e8e4ad30171ae00","observation_id":"71d8efd2-22c5-40c3-b32e-9750cd307da2","resolution":{"observed_at":"2026-08-05T00:48:49.383630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T17:11:46.281928Z","title":"arXiv preprint arXiv:2310.02446 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03532","last_updated":"2026-08-04T12:13:43Z","snapshot_observed_at":"2026-08-15T15:00:01.798945Z","submitted_at":"2026-08-04T12:13:43Z","title":"Cross-Lingual Bias in Large Language Models: A Comparative Analysis of English and Swahili","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T17:11:46.281928Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2608.03532"},"observation_digest":"sha256:ea0f92a36b9e20398774c606804235d5d4c106bf826ce31f224e82e367a7c9cc","observation_id":"d5e71f74-3316-4a22-91b4-87fd5cdccce7","resolution":{"observed_at":"2026-08-05T17:11:46.281928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-11T23:44:39.628652Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09095","last_updated":"2026-08-10T03:48:47Z","snapshot_observed_at":"2026-08-16T15:58:17.043733Z","submitted_at":"2026-08-10T03:48:47Z","title":"Who Bridges Safety? Identifying and Targeting Cross-Lingual Shared Safety Pathways","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-11T23:44:39.628652Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2608.09095"},"observation_digest":"sha256:e7423c63b5dd1f144c0244e1c9679c00e98240fb1c023117300947d0943717e7","observation_id":"99a6199e-6ae3-40ec-b128-1a5692750599","resolution":{"observed_at":"2026-08-11T23:44:39.628652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-11T04:15:50.149734Z","title":"arXiv preprint arXiv:2310.02446 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09925","last_updated":"2026-08-10T17:59:05Z","snapshot_observed_at":"2026-08-20T07:04:46.927279Z","submitted_at":"2026-08-10T17:59:05Z","title":"From Values to Benchmarks: Evaluating Large Language Models for Governmental Use in Dutch","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T04:15:50.149734Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2608.09925"},"observation_digest":"sha256:d1b181b8bf374521be2203951091cad7ab763db3fdd0ccef312b73356aba81a5","observation_id":"749fd45f-f6c6-445f-80e0-106a461a5a3b","resolution":{"observed_at":"2026-08-11T04:15:50.149734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2310.02446/citation-record","integrity":"/paper/2310.02446/integrity","json":"/paper/2310.02446/citation-record.json","paper":"/paper/2310.02446"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jigsaw multilingual toxic comment classification","venue":null,"work_id":"acd2de50-2c59-482c-82e8-153db57bc84d","year":2020},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:9c3e8e8beb761d1ad2151129bda02d435d667eaa0b7f2df3e48f4eff0462d5b7","observation_id":"5e72d20d-cb82-4ea1-89b3-dc50d883d2a1","resolution":{"observed_at":"2026-05-17T09:24:14.160455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":"2204.05862","doi":"10.1016/j.respol.2005.01.014","metadata_source":"pith","pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","venue":"cs.CL","work_id":"a1f2574b-a899-4713-be60-c87ba332656c","year":2022},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:8c954090f13bdd0002c90aea370985849b343c25c7f586e47b8dca6c35bb59fa","observation_id":"e9a0fc17-468f-4c68-bd18-7f1c68c99cce","resolution":{"observed_at":"2026-05-17T09:24:14.051786Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":"2212.08073","doi":"10.48550/arxiv.2212.08073","metadata_source":"pith","pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Constitutional AI: Harmlessness from AI Feedback","venue":"cs.CL","work_id":"faaaa4e0-2676-4fac-a0b4-99aef10d2095","year":2022},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:978dde2dadfe06da8c5eaca7a52baf29e8c2d55b588c601f88815f06b37d6cd8","observation_id":"0c7bde94-fae6-4b83-a86c-7ea8ff575dd3","resolution":{"observed_at":"2026-05-17T09:24:14.056610Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-15T03:08:13.900899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T03:08:13.900899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04023","last_updated":"2023-11-28T09:01:12Z","snapshot_observed_at":"2026-08-07T14:17:12.140094Z","submitted_at":"2023-02-08T12:35:34Z","title":"A Multitask, Multilingual, Multimodal Evaluation of ChatGPT on Reasoning, Hallucination, and Interactivity","version":4},"cited_work":{"arxiv_id":"2302.04023","doi":"10.48550/arxiv.2302.04023","metadata_source":"pith","pith_arxiv_id":"2302.04023","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Multitask, Multilingual, Multimodal Evaluation of ChatGPT on Reasoning, Hallucination, and Interactivity","venue":"cs.CL","work_id":"41dff74c-00b2-4c77-a674-9f86030c06c8","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2302.04023","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:1330fdb91bee1e15cfec92401df3aab71f27416a6d0da5882856be66ace5b049","observation_id":"6b329777-af2e-41bb-a5a0-df452fbdbe7b","resolution":{"observed_at":"2026-05-17T19:58:48.184559Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.03983","last_updated":"2022-07-06T19:51:48Z","snapshot_observed_at":"2026-08-16T17:01:45.784733Z","submitted_at":"2022-05-09T00:24:13Z","title":"Building Machine Translation Systems for the Next Thousand Languages","version":3},"cited_work":{"arxiv_id":"2205.03983","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.03983","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Building machine translation systems for the next thousand languages","venue":null,"work_id":"c55757ac-fd65-4628-8d13-7ce5b6c20ff0","year":2022},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2205.03983","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:adcf4aca335439251f6a1ba41f5f67efd4154dbe7730e52376de0a59e07ba231","observation_id":"b5fb6dfc-815c-4b8a-ac26-79100018e9ff","resolution":{"observed_at":"2026-05-17T09:24:14.067395Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11596","last_updated":"2023-10-25T03:52:07Z","snapshot_observed_at":"2026-08-16T15:06:35.991757Z","submitted_at":"2023-08-22T17:44:18Z","title":"SeamlessM4T: Massively Multilingual & Multimodal Machine Translation","version":3},"cited_work":{"arxiv_id":"2308.11596","doi":"10.48550/arxiv.2308.11596","metadata_source":"arxiv_reference","pith_arxiv_id":"2308.11596","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"C.; Dale, D.; Dong, N.; Duquenne, P.-A.; Elsahar, H.; Gong, H.; Heffernan, K.; Hoffman, J.; et al","venue":"arXiv (Cornell University)","work_id":"9b58185d-8084-4802-9271-58d052a5af84","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2308.11596","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:9e65beb77f387512c5f0b3e8a7e114e5ecfde468bbde6c54f3b0529dc8c94a95","observation_id":"219cdd08-98ae-4c38-8b7d-cf470028a56c","resolution":{"observed_at":"2026-05-17T09:24:14.072280Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.acl-long.376","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Systematic inequalities in language technology performance across the world’s languages","venue":"Proceedings of the 60th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)","work_id":"5437b416-712f-4a01-964a-9fef696d0b28","year":2022},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:335553988f93a6a1eca4e09458b8bd0f5228cdfe9fabd366afa785e5fd8531cf","observation_id":"13f29bdb-d3c3-4d2b-a314-aae22063b8a2","resolution":{"observed_at":"2026-05-17T09:24:13.988038Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15447","last_updated":"2024-05-06T06:36:24Z","snapshot_observed_at":"2026-08-19T05:26:53.768321Z","submitted_at":"2023-06-26T17:18:44Z","title":"Are aligned neural networks adversarially aligned?","version":2},"cited_work":{"arxiv_id":"2306.15447","doi":"10.48550/arxiv.2306.15447","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.15447","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adversarial examples are not easily detected: Bypassing ten detection methods","venue":"arXiv (Cornell University)","work_id":"cbf9eae3-40c5-419a-9f5b-335eab5a2bb2","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2306.15447","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:a5f403fb1234a1d059c67a685369895e16b33fd47b3f8ca28d04f5690459e7d5","observation_id":"aaa59a1f-99e0-40dd-96fc-eb6c8f354cf4","resolution":{"observed_at":"2026-05-17T09:24:14.078179Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aim","venue":null,"work_id":"3b4abc7c-c55e-4e11-a43c-c2eab19e9c65","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:b38197df04f398a93efcb6781a97139841659afc4c7418331f96d99aeda7504b","observation_id":"b01ba6a5-539a-49b6-ac68-ceef593ea4db","resolution":{"observed_at":"2026-05-17T09:24:14.195909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Translatorbot","venue":null,"work_id":"e4ae0186-a9e6-4748-b676-88a45981978a","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:d7cd95e9ba0c9a3eb832a5d81a22ddc16c51c91fd22df8b658c1594d28c9201a","observation_id":"8b8efac4-acfa-4301-ba0d-53d29aa78aee","resolution":{"observed_at":"2026-05-17T09:24:14.156570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How is chatgpt’ s behavior changing over time?","venue":null,"work_id":"cf6a8076-36b9-479f-b684-dfe2b138e8cd","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:fa1789f521f40a4aca512176707789746b3f3198fd9d5912ea76fc48022d6346","observation_id":"f591f313-3f61-4f47-a7e7-f7061bb8b0d7","resolution":{"observed_at":"2026-05-17T09:24:14.152934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/p19-1271","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CONAN - CO unter NA rratives through Nichesourcing: a Multilingual Dataset of Responses to Fight Online Hate Speech","venue":null,"work_id":"c6b04b8c-380c-4b94-9202-0806de3cffa6","year":2019},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:9808ba2ad7682f6e33afc6b263f4ce9cc8ac9816ae11f87d82f052dbfdf1d827","observation_id":"7a7bdd74-4784-4e57-8152-a089145dcfa0","resolution":{"observed_at":"2026-05-17T09:24:13.977286Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-05-22T07:23:22.949492+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T07:23:22.949492+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language support","venue":null,"work_id":"3b66e1e2-49a6-4e88-a543-7362021138a7","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:220d0e38143b827370fdccfb7d1806da98da421372c0b9956e9f09e5d1cb2cc8","observation_id":"18cc0caf-5821-472c-80b6-9923e21a9ac2","resolution":{"observed_at":"2026-05-17T09:24:14.202322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04672","last_updated":"2022-08-25T17:10:53Z","snapshot_observed_at":"2026-07-06T13:29:47.927628Z","submitted_at":"2022-07-11T07:33:36Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","version":3},"cited_work":{"arxiv_id":"2207.04672","doi":"10.18653/v1/w19-5207","metadata_source":"pith","pith_arxiv_id":"2207.04672","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","venue":"cs.CL","work_id":"68c8336c-d20e-40fa-ba9c-89459da6fc1a","year":2022},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2207.04672","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:1ab8d0a3871d81deca85e5abea95705af615c73de9e173f468fbc5082af70bcb","observation_id":"e62dc9e1-ae2c-4462-b764-cd3397c9b422","resolution":{"observed_at":"2026-05-17T09:24:14.083503Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06474","last_updated":"2024-03-04T04:03:54Z","snapshot_observed_at":"2026-08-20T04:04:43.980873Z","submitted_at":"2023-10-10T09:44:06Z","title":"Multilingual Jailbreak Challenges in Large Language Models","version":3},"cited_work":{"arxiv_id":"2310.06474","doi":"10.48550/arxiv.2310.06474","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.06474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multilingual jailbreak challenges in large language models","venue":"arXiv (Cornell University)","work_id":"97d238ad-7e44-4a09-90f1-ca400f5296e3","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2310.06474","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:3b5bda76efd8e5fbb7274e04495d7f7ff7884c377ff741ca844871a6915030ba","observation_id":"04d3ddc6-f5a7-4f7b-bdf8-64de9578d4e5","resolution":{"observed_at":"2026-05-17T09:24:14.088763Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:27:30.347033+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:27:30.347033+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-08-21T13:43:54.063053Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":"2209.07858","doi":"10.1136/bcr-2013-201554","metadata_source":"pith","pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","venue":"cs.CL","work_id":"1aabd84d-3779-4ba9-ba2f-15ce264a9b1e","year":2022},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:fe95d327ac04e3bbde0895581e96eaa6d57f9f3fc340361ce4c0e514254ad927","observation_id":"d61f5fa9-4e48-4a36-bd26-410023f9f859","resolution":{"observed_at":"2026-05-17T09:24:14.093690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07459","last_updated":"2023-02-18T21:30:27Z","snapshot_observed_at":"2026-08-16T15:55:15.315299Z","submitted_at":"2023-02-15T04:25:40Z","title":"The Capacity for Moral Self-Correction in Large Language Models","version":2},"cited_work":{"arxiv_id":"2302.07459","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.07459","snapshot_observed_at":"2026-07-09T21:36:34.279815Z","title":"The capacity for moral self-correction in large language models","venue":"cs.CL","work_id":"16e940b0-9e2f-4ac1-b64f-ca0c8f2c07ee","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2302.07459","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:7b1112eb7d4ac388f9a566d5a3779f5c909a8f17763d214a2e0303731260e8f6","observation_id":"ca8d4468-837a-4cf2-9522-c86a72686373","resolution":{"observed_at":"2026-05-17T09:24:13.993100Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11462","last_updated":"2020-09-25T20:22:26Z","snapshot_observed_at":"2026-08-18T05:13:24.803705Z","submitted_at":"2020-09-24T03:17:19Z","title":"RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models","version":2},"cited_work":{"arxiv_id":"2009.11462","doi":null,"metadata_source":"pith","pith_arxiv_id":"2009.11462","snapshot_observed_at":"2026-07-03T11:08:03.490494Z","title":"RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models","venue":"cs.CL","work_id":"6a137b3a-68fe-4f2e-aad1-ca042346408f","year":2020},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2009.11462","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:eb271f64e73487d7ba52eb082c45a1bf7321634ef24dfaffcf367d0070979a0c","observation_id":"2b9bd19b-c2ff-43e8-bece-f59a28d16c28","resolution":{"observed_at":"2026-05-17T09:24:14.001152Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10510","last_updated":"2023-05-17T18:30:05Z","snapshot_observed_at":"2026-08-17T15:41:52.695430Z","submitted_at":"2023-05-17T18:30:05Z","title":"ChatGPT Perpetuates Gender Bias in Machine Translation and Ignores Non-Gendered Pronouns: Findings across Bengali and Five other Low-Resource Languages","version":1},"cited_work":{"arxiv_id":"2305.10510","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.10510","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chatgpt perpetuates gender bias in machine translation and ignores non-gendered pronouns: Findings across bengali and five other low-resource languages","venue":null,"work_id":"5212ebc2-2d8f-4301-98b9-fc2acd5f7c2a","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2305.10510","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:d8c683772f3d530430b3776b204490711258659be0971f0aba9073132517f86e","observation_id":"e7b74f7a-3319-40b6-9828-ee47aa8e1a69","resolution":{"observed_at":"2026-05-17T09:24:14.006742Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09210","last_updated":"2023-02-18T02:11:36Z","snapshot_observed_at":"2026-08-17T05:42:24.349196Z","submitted_at":"2023-02-18T02:11:36Z","title":"How Good Are GPT Models at Machine Translation? A Comprehensive Evaluation","version":1},"cited_work":{"arxiv_id":"2302.09210","doi":"10.48550/arxiv.2302.09210","metadata_source":"arxiv_reference","pith_arxiv_id":"2302.09210","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"ce8aed1e-38cf-4d49-abd0-0532147aa323","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2302.09210","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:30f3c4759eba23103db296d2f6a510f1103b3d1874c95e46426021c94bf1a44d","observation_id":"0e89f9f4-fe39-4c91-8a25-cee6e716fd93","resolution":{"observed_at":"2026-05-17T09:24:14.011839Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-05-24T10:53:29.406822+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T10:53:29.406822+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.16244","last_updated":"2023-06-28T14:14:44Z","snapshot_observed_at":"2026-08-18T11:58:37.566483Z","submitted_at":"2023-06-28T14:14:44Z","title":"CBBQ: A Chinese Bias Benchmark Dataset Curated with Human-AI Collaboration for Large Language Models","version":1},"cited_work":{"arxiv_id":"2306.16244","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.16244","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cbbq: A chinese bias benchmark dataset curated with human-ai collaboration for large language models","venue":null,"work_id":"199161ff-9748-4499-afe6-8de60b5eee5a","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2306.16244","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:c0a4b2e25fa4ea5e087abfc501c39d584b4fa2250168744e5c61af5fd1fdbc76","observation_id":"0c0b38fe-4593-4552-94dd-9939bdb963cb","resolution":{"observed_at":"2026-05-17T09:24:14.017094Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d17-1215","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adversarial Examples for Evaluating Reading Comprehension Systems","venue":null,"work_id":"9080569c-975f-437e-8f93-1e6c8acbb5aa","year":2017},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:e2c19677bce953a958c050e306be0a3f8cb17ec31184aaf70e5056be1862e0aa","observation_id":"cc8c84f2-b9fd-4b84-a239-02149dd89211","resolution":{"observed_at":"2026-05-17T09:24:13.958411Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Automatically auditing large language models via discrete optimization","venue":null,"work_id":"11f9b71f-b12e-4465-80ba-04bb9226dc18","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:82da885b364313393aa22dafd591a66cdb666285165826bae73af5bfc777dda8","observation_id":"04bd32f9-f9f1-4d67-a811-b4c28128b5be","resolution":{"observed_at":"2026-05-17T09:24:14.188704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:17:03.600265Z","title":"In: Zong, C., Xia, F., Li, W., Navigli, R","venue":null,"work_id":"8d675bdd-79ca-48d6-9163-fc17ce0e8ece","year":2024},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:544567be20f689fe89d7a35323c76a9102894f5a6fd0eb4a799f1c67e4c628dc","observation_id":"131b6eb3-5c38-44e4-a3ea-c702abe7d8a6","resolution":{"observed_at":"2026-05-17T09:24:13.966278Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05613","last_updated":"2023-04-12T05:08:52Z","snapshot_observed_at":"2026-08-16T15:41:06.942429Z","submitted_at":"2023-04-12T05:08:52Z","title":"ChatGPT Beyond English: Towards a Comprehensive Evaluation of Large Language Models in Multilingual Learning","version":1},"cited_work":{"arxiv_id":"2304.05613","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.05613","snapshot_observed_at":"2026-07-04T06:39:37.886063Z","title":"Chatgpt beyond english: Towards a comprehensive evaluation of large language models in multilingual learning","venue":null,"work_id":"13df0b03-67a8-4c09-acc9-4ec61334f121","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2304.05613","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:97ec3ae08bc6f6f1aa5fea2ede3656106addd53997f964d145366682b8d5742d","observation_id":"598b2da4-21a7-49c8-a406-61cd6a4a7fe3","resolution":{"observed_at":"2026-05-17T09:24:14.021973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-16T15:03:33.817088Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.01446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open sesame! universal black box jailbreaking of large language models","venue":null,"work_id":"153226da-2665-4072-9525-a1b0e29db394","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:0a0a290bd3ae05cfa63c47b8b79194c5131e6196e6b17cd20a3e36cf57eb09e8","observation_id":"a9e0449a-d2cf-4d77-a059-af389bc5cba1","resolution":{"observed_at":"2026-05-17T09:24:14.027167Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07124","last_updated":"2023-10-09T03:34:01Z","snapshot_observed_at":"2026-08-19T03:18:22.679345Z","submitted_at":"2023-09-13T17:59:09Z","title":"RAIN: Your Language Models Can Align Themselves without Finetuning","version":2},"cited_work":{"arxiv_id":"2309.07124","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.07124","snapshot_observed_at":"2026-07-03T04:27:37.151450Z","title":"Rain: Your language models can align themselves without finetuning","venue":null,"work_id":"bf51f407-2426-4136-9e1b-7a596b6b9f2e","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2309.07124","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:2578797a3daff49c3f77ac26f520269b0e6959a0bdea37dd117ca0c10f2e7a10","observation_id":"a5b85d78-6265-42c0-9c07-e5efde7decc1","resolution":{"observed_at":"2026-05-17T09:24:14.031548Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13860","last_updated":"2024-03-10T13:58:08Z","snapshot_observed_at":"2026-08-19T22:25:04.062400Z","submitted_at":"2023-05-23T09:33:38Z","title":"Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study","version":2},"cited_work":{"arxiv_id":"2305.13860","doi":"10.48550/arxiv.2305.13860","metadata_source":"pith","pith_arxiv_id":"2305.13860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study","venue":"cs.SE","work_id":"63e07f6a-433d-4bb2-ba7d-a8886e09211d","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2305.13860","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:598d3de120f5cb70b200e9465e583280e373b088271d8ad5cafa2d10a65368a1","observation_id":"483431eb-9134-4d95-a57c-18e5efb866bd","resolution":{"observed_at":"2026-05-17T09:24:14.036520Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-05-24T11:53:04.272267+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T11:53:04.272267+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Black box adversarial prompting for foundation models","venue":null,"work_id":"d1cc9bdd-a456-4c6d-9feb-b6da9d464859","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:14b5b0575cecb67de251ca2788459b6db346ee233d036ec13c3bea331e90f8df","observation_id":"46f48306-cf34-4f9e-88dd-044c93055af9","resolution":{"observed_at":"2026-05-17T09:24:14.184738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07790","last_updated":"2021-11-28T01:32:21Z","snapshot_observed_at":"2026-08-16T18:05:11.939394Z","submitted_at":"2021-08-04T22:18:10Z","title":"Mitigating harm in language models with conditional-likelihood filtration","version":3},"cited_work":{"arxiv_id":"2108.07790","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2108.07790","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mitigating harm in language models with conditional-likelihood ﬁltration","venue":null,"work_id":"fc86b9e4-a50c-4b4b-91da-ed67e6735249","year":2021},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2108.07790","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:1defce56460e5f65fb95d5ae9148b20dc8ffd755404fcb6ad17292cd11c534b9","observation_id":"9d73e60d-b501-4dee-a32b-1e4db372e2c8","resolution":{"observed_at":"2026-05-17T09:24:14.042036Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Duolingo","venue":null,"work_id":"94b7f199-5195-41a7-b1ab-355f81e2dc89","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:cde46698f80b798a5e235c980a5576d42a4fb32afd896319734b82b805d356ae","observation_id":"b99b48e9-72ed-4ed6-91a2-21029ab93649","resolution":{"observed_at":"2026-05-17T09:24:14.164588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:5e1bd23f76f064ba147894706aecf4659f945a31dbfa45adb4c14ea935c5d869","observation_id":"81e4e847-266b-464c-8427-c6cc4a671b6f","resolution":{"observed_at":"2026-05-17T09:24:14.098278Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Government of iceland","venue":null,"work_id":"c25a4d3f-4d13-4b14-bb1b-741e88035158","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:f7d3dbaa5deaf656d2156752c331d6fd107dfb9879e26ca5a6b771f3c17b362a","observation_id":"8ad5a889-6ccd-40e0-a9b0-9d196c7f40ff","resolution":{"observed_at":"2026-05-17T09:24:14.172750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"b30c53dd-af53-4112-ba4b-8f01cc81b13d","year":2022},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:e3682577b891570875a429b50aab73476ceac25786b600afbd1f24a5847b1289","observation_id":"12a17a2d-2c7d-4e80-9324-431856a8b931","resolution":{"observed_at":"2026-05-17T09:24:14.176969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Practical black-box attacks against machine learning","venue":null,"work_id":"d05c40a9-f873-4e3c-8b5f-99f8200ac1a5","year":2017},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:376a398b7319557550be7addc4229ebce2592d1bf2e16a4d4be103f12c085ebb","observation_id":"ac28dea0-70dc-434f-8893-d5c0546ece81","resolution":{"observed_at":"2026-05-17T09:24:14.180901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.emnlp-main.225","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proceedings of the 2022 Conference on Empirical Methods in Natural Language Processing , year =","venue":null,"work_id":"664322b7-6ac6-46c5-b1f2-193a778945d2","year":2022},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:e1786880defa7613e1be4c2df703ec181c8831727ba4f9dba801a26bee4f6639","observation_id":"0787857b-a8df-42d5-bf61-374879735b70","resolution":{"observed_at":"2026-05-17T09:24:13.984406Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-13T19:08:31.855243+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T19:08:31.855243+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.findings-acl.184","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Square one bias in NLP: Towards a multi-dimensional exploration of the research manifold","venue":"Findings of the Association for Computational Linguistics: ACL 2022","work_id":"2f77f451-f865-4267-9630-ba406b3829e7","year":2022},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:8e93ecab9c0b7fd78604aee1340604d774016157ee0cdc21a8fddcdc7c8e1558","observation_id":"01370b94-dcf8-41bc-9c85-7ee731412362","resolution":{"observed_at":"2026-05-17T09:24:13.962385Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16149","last_updated":"2023-09-29T11:51:51Z","snapshot_observed_at":"2026-08-20T19:35:31.474618Z","submitted_at":"2023-08-30T17:07:17Z","title":"Jais and Jais-chat: Arabic-Centric Foundation and Instruction-Tuned Open Generative Large Language Models","version":2},"cited_work":{"arxiv_id":"2308.16149","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.16149","snapshot_observed_at":"2026-07-04T10:29:45.228471Z","title":"Jais and jais-chat: Arabic-centric foundation and instruction-tuned open gener- ative large language models","venue":null,"work_id":"83df034a-976c-49c2-8c27-27c38e37f16e","year":2019},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2308.16149","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:f375f3418beb332af96edaf85c193adfbb20e2832a659089879cf58f6cbd5920","observation_id":"60843afb-dff2-4f62-8c60-270121e8c023","resolution":{"observed_at":"2026-05-17T09:24:14.103926Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03825","last_updated":"2024-05-15T12:06:31Z","snapshot_observed_at":"2026-08-16T09:32:10.049300Z","submitted_at":"2023-08-07T16:55:20Z","title":"\"Do Anything Now\": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models","version":2},"cited_work":{"arxiv_id":"2308.03825","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.03825","snapshot_observed_at":"2026-07-10T17:17:25.614333Z","title":"\"Do Anything Now\": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models","venue":"cs.CR","work_id":"73c8e776-cd59-4029-b3fe-4579d64d9014","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2308.03825","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:9dbde0fc41655c6d36689dd698f0351c70aa5b0bd84afa4d4fca7002adcdd044","observation_id":"7917c3f2-b8f1-4ea4-b9b0-9297702edb8b","resolution":{"observed_at":"2026-05-17T09:24:14.108875Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Why so toxic? measuring and triggering toxic behavior in open-domain chatbots","venue":null,"work_id":"b615f605-dcde-4fb6-a04c-6e453f706751","year":2022},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:99dac69658a017cc469ecbf7f7d49a543ad5aff229df27cc66cc18328a6f1510","observation_id":"66951f9c-76a9-4887-ae4c-e98a35690c26","resolution":{"observed_at":"2026-05-17T09:24:14.199218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.naacl-main.291","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal Adversarial Attacks with Natural Triggers for Text Classification","venue":null,"work_id":"eeeb324d-cc29-45c4-8ac5-f5229c7186b5","year":2021},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:0516dcddd4f6e9a55412450d3082ceea1aeb7c4bd6ab4f096eeec73f79359582","observation_id":"acd2ece7-94dc-45ec-8189-b05f8640fc37","resolution":{"observed_at":"2026-05-17T09:24:13.980555Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-05-23T05:23:07.737024+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T05:23:07.737024+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/p19-1164","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Smith, and Luke Zettlemoyer","venue":null,"work_id":"967aa4f3-f461-43ac-8668-616d37c49a45","year":2019},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:fecdd638dc67b24b4c5efd31e9fbc3507cc20f2833b427e27e53182a5edc2a5f","observation_id":"32623e82-77d5-40db-b16d-df78622b7075","resolution":{"observed_at":"2026-05-17T09:24:13.973601Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-21T21:08:20.170459+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-21T21:08:20.170459+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.americasnlp-1.17","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ChatGPT is not a good indigenous translator","venue":null,"work_id":"1ed3bb08-5f61-44ac-8753-434c3b00388c","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:85cdc83482988b78c8b9a84fca7dfa2052ef3d07128bbef8c31cc83b4c93271b","observation_id":"627295d0-7e0d-414f-bf2a-5336c4321232","resolution":{"observed_at":"2026-05-17T09:24:13.969936Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:fcf41ce129c644f9d9c5919927d63a0ee8e08d10e1888edd28a44fd4d848e160","observation_id":"78c6ff0a-89ac-4663-8bcd-12509abdb6fc","resolution":{"observed_at":"2026-05-17T09:24:14.113933Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Translated unleashes full gpt-4 potential for businesses operating in languages other than english","venue":null,"work_id":"7a704442-49da-48e1-8774-fe0169f9f70d","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:314f3bf0ed25867de783e8bfe45be013f9145ae7f9428892c2206176847782d0","observation_id":"0ff6e151-ef5f-4007-ab47-ae345e7a2c26","resolution":{"observed_at":"2026-05-17T09:24:14.168804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Universal adversarial triggers for attacking and analyzing NLP","venue":null,"work_id":"fb257349-f944-4d3d-93fa-9d78228deec2","year":2019},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:750afd49a4db0bdb2439111b3c792fe3c093bb16c35bbf0a633fa1d78c6f31d2","observation_id":"72278891-c65c-46c9-9701-4a09aece17b0","resolution":{"observed_at":"2026-05-17T09:24:14.192562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d19-1221","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/D19-1221","venue":null,"work_id":"edfb81d1-b34f-408d-a8e2-1aa33d1d0f35","year":2019},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:f17d5ea7b0693f6fcdef1f668806502d65935e22beeb72b54f84f450cf791364","observation_id":"8c99a8d6-11a8-41ac-a361-9c026a2860d2","resolution":{"observed_at":"2026-05-17T09:24:13.952968Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:39.764148+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:39.764148+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00905","last_updated":"2024-06-20T14:15:23Z","snapshot_observed_at":"2026-08-20T09:59:04.367473Z","submitted_at":"2023-10-02T05:23:34Z","title":"All Languages Matter: On the Multilingual Safety of Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.00905","doi":"10.48550/arxiv.2310.00905","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.00905","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InProceedings of the 2023 Conference on Empirical Methods in Natural Language Processing: System Demonstrations, pages 431–445, Singapore","venue":"arXiv (Cornell University)","work_id":"46a04130-1c4c-404f-a270-89fc5cdfeb4c","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2310.00905","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:52ae3d6665a0a6143b265be911d59ee4d14b9f5e777a90e199bf6cb37f7de467","observation_id":"0399a3eb-8607-4f73-8dc2-d8bbe1c13c06","resolution":{"observed_at":"2026-05-17T09:24:14.119258Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:27:24.235836+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:27:24.235836+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13387","last_updated":"2023-09-04T01:47:30Z","snapshot_observed_at":"2026-08-22T13:41:58.662402Z","submitted_at":"2023-08-25T14:02:12Z","title":"Do-Not-Answer: A Dataset for Evaluating Safeguards in LLMs","version":2},"cited_work":{"arxiv_id":"2308.13387","doi":"10.48550/arxiv.2308.13387","metadata_source":"arxiv_reference","pith_arxiv_id":"2308.13387","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards veri- fying the geometric robustness of large-scale neural net- works","venue":"arXiv (Cornell University)","work_id":"7d461849-cc8d-4f7f-bf07-6c5e9ea94914","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2308.13387","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:c25754e498204ef712570155cc2b00bc85f41a82e5ff89ae1c6cc2c466859ec0","observation_id":"49da06db-1474-4a09-96ad-1dec12bda0b5","resolution":{"observed_at":"2026-05-17T09:24:14.124720Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02483","last_updated":"2023-07-05T17:58:10Z","snapshot_observed_at":"2026-08-15T10:16:52.688429Z","submitted_at":"2023-07-05T17:58:10Z","title":"Jailbroken: How Does LLM Safety Training Fail?","version":1},"cited_work":{"arxiv_id":"2307.02483","doi":"10.48550/arxiv.2307.02483","metadata_source":"pith","pith_arxiv_id":"2307.02483","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbroken: How Does LLM Safety Training Fail?","venue":"cs.LG","work_id":"a0b5df13-7a81-4b15-afb4-c715e6b400bc","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2307.02483","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:cf5a5f3c4f785356153e469ab1811c01e7aff956e62aaff68266a447d1278500","observation_id":"1ccc29c5-7f42-49ea-96e3-e2803bffaaea","resolution":{"observed_at":"2026-05-17T09:24:14.129455Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-05-22T21:23:25.377799+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T21:23:25.377799+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.04359","last_updated":"2021-12-08T16:09:48Z","snapshot_observed_at":"2026-08-09T15:17:43.394064Z","submitted_at":"2021-12-08T16:09:48Z","title":"Ethical and social risks of harm from Language Models","version":1},"cited_work":{"arxiv_id":"2112.04359","doi":"10.48550/arxiv.2112.04359","metadata_source":"pith","pith_arxiv_id":"2112.04359","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ethical and social risks of harm from Language Models","venue":"cs.CL","work_id":"b4ce1c45-ef69-445a-a872-dbb785b485e9","year":2021},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2112.04359","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:5adc111636b5f4999e7f98c5bd70f0eac6b1a863a640862446954cb805bb7636","observation_id":"5a10364c-fc48-4275-aaf5-b3028be8ea66","resolution":{"observed_at":"2026-05-17T09:24:14.134418Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-12T23:50:40.702477+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T23:50:40.702477+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13592","last_updated":"2023-09-12T16:35:30Z","snapshot_observed_at":"2026-08-18T16:48:34.306405Z","submitted_at":"2023-03-23T18:16:30Z","title":"Prompting Multilingual Large Language Models to Generate Code-Mixed Texts: The Case of South East Asian Languages","version":4},"cited_work":{"arxiv_id":"2303.13592","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.13592","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prompting large language models to generate code-mixed texts: The case of south east asian languages","venue":null,"work_id":"a052bf01-dc8d-4cec-bb6d-0adca745f368","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2303.13592","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:055896da2163fa99d5fcaa941b388a61a7f39ce7df47c980f134bc1683477b6d","observation_id":"f7fbf205-4ce9-41bc-af92-228ed6990f92","resolution":{"observed_at":"2026-05-17T09:24:14.139522Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06463","last_updated":"2024-03-26T04:23:12Z","snapshot_observed_at":"2026-08-19T19:09:36.928554Z","submitted_at":"2023-08-12T04:05:57Z","title":"GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher","version":2},"cited_work":{"arxiv_id":"2308.06463","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.06463","snapshot_observed_at":"2026-07-09T10:26:11.073540Z","title":"Gpt- 4 is too smart to be safe: Stealthy chat with llms via cipher","venue":"cs.CL","work_id":"c0bea3ab-35ce-4045-8b4f-46d34943d688","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2308.06463","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:67173c00d04dce6ae9ddcb12c4797cab7cf0d8c108c7a6fdf986a2ae7db5e2cc","observation_id":"f61039f2-9233-45ab-8844-f48251c0a235","resolution":{"observed_at":"2026-05-17T09:24:14.144341Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12867","last_updated":"2023-05-29T17:46:54Z","snapshot_observed_at":"2026-08-20T08:26:56.516447Z","submitted_at":"2023-01-30T13:20:48Z","title":"Red teaming ChatGPT via Jailbreaking: Bias, Robustness, Reliability and Toxicity","version":4},"cited_work":{"arxiv_id":"2301.12867","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.12867","snapshot_observed_at":"2026-07-09T09:56:10.738322Z","title":"Red teaming ChatGPT via Jailbreaking: Bias, Robustness, Reliability and Toxicity","venue":"cs.CL","work_id":"e0034c92-5e8a-444c-8689-3c360e8c3e70","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2301.12867","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:5994258b1c54419e176ca7fb9d593002b4eaaf9add9a2993413d8a3497fe505b","observation_id":"560fcd23-4622-413e-ae6f-a792a3e6af88","resolution":{"observed_at":"2026-05-17T09:24:14.149204Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":"2307.15043","doi":"10.48550/arxiv.2307.15043","metadata_source":"pith","pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","venue":"cs.CL","work_id":"3322fa86-1768-4677-8425-dd326b45e078","year":2023},"citing_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-17T09:24:13.911401Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2310.02446"},"observation_digest":"sha256:b277925b47672079bc9f56b70f5b76ac8be2e2738e68b801464013a9db212534","observation_id":"8bc99e31-5022-4f5d-8b1b-659d0ef8fd2e","resolution":{"observed_at":"2026-05-17T09:24:14.046876Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":1,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":0,"verified_exact":35,"verified_fuzzy":14},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 88 inbound Pith citation observations for arXiv:2310.02446."}