{"as_of":"2026-08-08T02:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1f6ce288b5aafb3187590eb49f0785af654b8b8b7bc74c5c7705be95dfdad5db","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:27:07.201702Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.18864/citation-record","integrity":"/paper/2505.18864/integrity","json":"/paper/2505.18864/citation-record.json","paper":"/paper/2505.18864"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:05.132678Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.132678Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:949777c70ff7acab477b742d5a01b258b47f6fabcdb5be43f0cdc93a9e4dd00f","observation_id":"9783f24b-c7e0-464c-a996-405b245d9c81","resolution":{"observed_at":"2026-08-07T14:27:05.132678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:27:05.196595Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.196595Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:9fbcf9664628de97920b94545ed127bf0f4aa58f8705c8c2c922d6478a1e45f2","observation_id":"1fc38698-cb47-41b6-af77-d56762fd6d30","resolution":{"observed_at":"2026-08-07T14:27:05.196595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11000","last_updated":"2023-05-19T14:41:16Z","snapshot_observed_at":"2026-08-07T10:56:05.622094Z","submitted_at":"2023-05-18T14:23:25Z","title":"SpeechGPT: Empowering Large Language Models with Intrinsic Cross-Modal Conversational Abilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11000","snapshot_observed_at":"2026-08-07T14:27:05.265383Z","title":"Speechgpt: Empowering large language models with intrinsic cross- modal conversational abilities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.265383Z"},"links":{"cited_paper":"/paper/2305.11000","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:ab59e5c22cf303e60a4f9b460c674b1522cac6722540285f95023ae3e705427a","observation_id":"e81487cf-ddf4-43f5-ad6d-e85a6d6ba353","resolution":{"observed_at":"2026-08-07T14:27:05.265383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:05.360972Z","title":"Next-gpt: Any-to-any multimodal llm,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.360972Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:941c648928beb3eb381111d2771eb34194abdc32cfa3e4f71d1c6a90f0f9690d","observation_id":"eb7a9dfb-db57-4172-ab6b-1cc63bff6664","resolution":{"observed_at":"2026-08-07T14:27:05.360972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T14:27:05.421186Z","title":"Gpt-4o system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.421186Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:36479038066bd97ff8b60b76d987a66b35cf9346a2cc8d812076defcbef63f9b","observation_id":"bf40bfaa-f3ff-4554-9c86-b7bd836d17cb","resolution":{"observed_at":"2026-08-07T14:27:05.421186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:08.927017Z","title":"Introducing copilot+ pcs,","venue":null,"work_id":"f28eac04-0f20-4da8-84bf-d7ef195d25b5","year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.438804Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:0fae214e7184dc439bd3a75a6097045382d3786c2b0a0519999af59e6fda1e59","observation_id":"8ae256d3-57df-453d-91ee-bf054a762f04","resolution":{"observed_at":"2026-08-07T14:27:09.002097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:08.735259Z","title":"People are suddenly flocking to chatgpt plus on mobile – here’s why,","venue":null,"work_id":"687998e0-b790-4048-9c38-6ed403440583","year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.442507Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:05a23aa9ed40f69e9efe4ba1b04891d18858ca3df2c1ca5e58e57beeb3ede2d9","observation_id":"a9f1d635-76e6-4968-95bb-824d7747ff71","resolution":{"observed_at":"2026-08-07T14:27:08.823172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:08.572379Z","title":"Apple is finalizing a deal with openai to put chatgpt on the iphone, while talks with google to use gemini are ongoing,","venue":null,"work_id":"061f0cdf-5662-4af4-b30c-e93ef46ea8ea","year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.445863Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:5569080055fa969ea97b1aa628477d3f9f2ab7333b134dc0444615342656b5de","observation_id":"3ba6d420-11dd-49d2-886c-bb90d9cf8262","resolution":{"observed_at":"2026-08-07T14:27:08.653643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19103","last_updated":"2024-05-29T14:07:44Z","snapshot_observed_at":"2026-07-06T18:22:01.301152Z","submitted_at":"2024-05-29T14:07:44Z","title":"Voice Jailbreak Attacks Against GPT-4o","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19103","snapshot_observed_at":"2026-08-07T14:27:05.448953Z","title":"V oice jailbreak attacks against gpt-4o,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.448953Z"},"links":{"cited_paper":"/paper/2405.19103","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:1fd625c5a0958d63f5e73c36607dcbc9396903424f22cb54f5bfd6eac87c2ae5","observation_id":"410cd221-4ffe-405a-bedf-a2119c9870f6","resolution":{"observed_at":"2026-08-07T14:27:05.448953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-07T14:27:05.454954Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.454954Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:b7d563e5d7a6fd0f8b6d1bb00feb64c0ce10e877768192ae8781000871c00de0","observation_id":"ff308d94-1d19-4bd4-9ccb-5d87ccfa5b57","resolution":{"observed_at":"2026-08-07T14:27:05.454954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:08.398134Z","title":"\" do anything now","venue":null,"work_id":"b2d4f44f-5f19-436a-8caa-467f549c2f95","year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.459631Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:876ebf51a00fe67dfd18d43b100ab0e2670b307291e920d07ce8e30b4cbc848d","observation_id":"874ccb10-04bf-45d1-8d33-79a4164ba43f","resolution":{"observed_at":"2026-08-07T14:27:08.474985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T14:27:05.502184Z","title":"Universal and transferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.502184Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:92bd5eddaf094367f256037cab2263b253f474f07ee26da4d0319e67c9954ba7","observation_id":"78cda8c7-098c-4013-93ad-318f79697e19","resolution":{"observed_at":"2026-08-07T14:27:05.502184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:08.224866Z","title":"Gpt-4v system card,","venue":null,"work_id":"1e318b3a-fd06-47db-a033-9b2541e6f407","year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.556029Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:d767940cbb6210648d2ddda01755ec8a7168b03274759d5c66ce86b0e1b77ce4","observation_id":"aac3bf77-b9b6-49fa-9ce9-9d6e4c5988cb","resolution":{"observed_at":"2026-08-07T14:27:08.313749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-08-08T01:20:38.655253Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-07T14:27:05.591822Z","title":"Com- prehensive assessment of jailbreak attacks against llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.591822Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:7cf847fb5c0997c90e7be4b9c5b0dcff268b7389db6e40f0ac66193c5d44703d","observation_id":"704992cc-917f-4293-987e-29d345098244","resolution":{"observed_at":"2026-08-07T14:27:05.591822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06987","last_updated":"2023-10-10T20:15:54Z","snapshot_observed_at":"2026-07-06T16:30:46.321160Z","submitted_at":"2023-10-10T20:15:54Z","title":"Catastrophic Jailbreak of Open-source LLMs via Exploiting Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06987","snapshot_observed_at":"2026-08-07T14:27:05.636865Z","title":"Catastrophic jailbreak of open-source llms via exploiting generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.636865Z"},"links":{"cited_paper":"/paper/2310.06987","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:b8ca66a8fd31b100974902efdcea1a27b64cf4f385e4dcccb394e472c18b2255","observation_id":"c2599b70-d583-44e8-89c5-536f57c6585f","resolution":{"observed_at":"2026-08-07T14:27:05.636865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05608","last_updated":"2025-01-19T16:23:38Z","snapshot_observed_at":"2026-07-06T16:45:24.070954Z","submitted_at":"2023-11-09T18:59:11Z","title":"FigStep: Jailbreaking Large Vision-Language Models via Typographic Visual Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05608","snapshot_observed_at":"2026-08-07T14:27:05.699522Z","title":"Figstep: Jailbreaking large vision-language models via typographic visual prompts,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.699522Z"},"links":{"cited_paper":"/paper/2311.05608","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:85efbc8fc67c762bd4db9b37a93ec14a3e5e99978a8218cc50c0e95ec3fca21a","observation_id":"0a8124b6-20c0-41e0-a7c7-ed3b7ee9bce7","resolution":{"observed_at":"2026-08-07T14:27:05.699522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05197","last_updated":"2023-11-01T05:14:01Z","snapshot_observed_at":"2026-07-06T15:14:24.794122Z","submitted_at":"2023-04-11T13:05:04Z","title":"Multi-step Jailbreaking Privacy Attacks on ChatGPT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05197","snapshot_observed_at":"2026-08-07T14:27:05.763058Z","title":"Multi-step jailbreaking privacy attacks on chatgpt,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.763058Z"},"links":{"cited_paper":"/paper/2304.05197","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:60fb28b9b96d51dd6a6ca03cc77ba6e1e049cc24470b5949ac93caf71b370599","observation_id":"f0a5b696-8e6d-41ff-a1ee-460b73b5c2e8","resolution":{"observed_at":"2026-08-07T14:27:05.763058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-07T14:27:05.797087Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.797087Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:699fb16280c347116ceab012ed12050df5385f7542773a1abf46358b1031de89","observation_id":"8ebe53d3-3459-4b01-9a48-555e3fffaf5d","resolution":{"observed_at":"2026-08-07T14:27:05.797087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10260","last_updated":"2024-08-27T03:32:47Z","snapshot_observed_at":"2026-08-04T21:32:35.483431Z","submitted_at":"2024-02-15T18:58:09Z","title":"A StrongREJECT for Empty Jailbreaks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10260","snapshot_observed_at":"2026-08-07T14:27:05.836755Z","title":"A strongreject for empty jailbreaks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.836755Z"},"links":{"cited_paper":"/paper/2402.10260","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:37e2ad167124dcedfe789881da5b0fe537dcc88f45562714723ac2cb308f1847","observation_id":"6c181256-d750-46cf-972b-abfc24242958","resolution":{"observed_at":"2026-08-07T14:27:05.836755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:05.882294Z","title":"Jailbroken: How does llm safety training fail?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.882294Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:2a0f15401b34212e55b3b338f55b05a75d094366bccfb408c513898e56de804b","observation_id":"7fb17c4f-ce07-4216-a432-6cc16cd5fb34","resolution":{"observed_at":"2026-08-07T14:27:05.882294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:05.959381Z","title":"Defending chatgpt against jailbreak attack via self-reminders,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.959381Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:4ef3977c2c7465b5c5872f1d81ad1bdb37eabd79c4b60a1dea79985d048821e3","observation_id":"be5d8f43-0a84-4ea0-85cc-d1bfdc3b8e6c","resolution":{"observed_at":"2026-08-07T14:27:05.959381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-07T14:27:05.964702Z","title":"Gptfuzzer: Red teaming large language models with auto-generated jailbreak prompts,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:05.964702Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:38c4eca5ad4b506cb93e741f1075d2e6241245cb469991937a7e5b26ba879fcc","observation_id":"7a45aba8-a5a4-4d25-8c3a-d1ce07d05868","resolution":{"observed_at":"2026-08-07T14:27:05.964702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06474","last_updated":"2024-03-04T04:03:54Z","snapshot_observed_at":"2026-08-08T01:21:39.731592Z","submitted_at":"2023-10-10T09:44:06Z","title":"Multilingual Jailbreak Challenges in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06474","snapshot_observed_at":"2026-08-07T14:27:06.003650Z","title":"Multilingual jailbreak challenges in large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.003650Z"},"links":{"cited_paper":"/paper/2310.06474","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:cf6048b160d5531c56fa90adca320a33d321db81424d96927c13a34459146483","observation_id":"0fd5edc6-90e2-417c-a5d7-48dc562f7d80","resolution":{"observed_at":"2026-08-07T14:27:06.003650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-07T14:27:06.090288Z","title":"Low-resource languages jailbreak gpt-4,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.090288Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:069e7f01f5bae2f278f51b4d24696bfc416c24ae744298e892711afb075f727d","observation_id":"87021e4c-06e4-467e-89ff-3457213ba352","resolution":{"observed_at":"2026-08-07T14:27:06.090288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T14:27:06.152780Z","title":"Jailbreaking black box large language models in twenty queries, 2024,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.152780Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:4883f99a81345133e3e1783f14d1a96e221e33606c1e441b2e3113ca280543b3","observation_id":"f588b785-fd02-44b0-aac1-b43d8a6d78be","resolution":{"observed_at":"2026-08-07T14:27:06.152780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:08.020696Z","title":"Tree of attacks: Jailbreaking black-box llms automatically,","venue":null,"work_id":"ead2124a-ea15-4553-a201-0df3114b077f","year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.261666Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:3ca589194c392a3a7cf9dd995f75b54168786f9aad0754970ea50911ea146739","observation_id":"c9f550d4-bac2-4c9a-8f7e-a883cc451fa8","resolution":{"observed_at":"2026-08-07T14:27:08.093291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-07T14:27:06.363295Z","title":"Smoothllm: Defending large language models against jailbreaking attacks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.363295Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:c74fe902165fc566dd16de02ecde8f486f24c29d2f5c9e7f14850db0943e4de2","observation_id":"2a70d9d9-063a-4599-956a-316db09dbcd7","resolution":{"observed_at":"2026-08-07T14:27:06.363295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:06.468716Z","title":"Vlattack: Multimodal adversarial attacks on vision-language tasks via pre-trained models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.468716Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:1d0181def9b2836044eb897b655d7d636d587d379845d4c38ffe8ae6072433ae","observation_id":"4e1a0703-3e20-4acb-b942-224d849ed9cf","resolution":{"observed_at":"2026-08-07T14:27:06.468716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13461","last_updated":"2024-08-24T04:31:37Z","snapshot_observed_at":"2026-07-06T19:05:22.642274Z","submitted_at":"2024-08-24T04:31:37Z","title":"Probing the Robustness of Vision-Language Pretrained Models: A Multimodal Adversarial Attack Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13461","snapshot_observed_at":"2026-08-07T14:27:06.572513Z","title":"Probing the robustness of vision-language pretrained models: A multimodal adversarial attack approach,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.572513Z"},"links":{"cited_paper":"/paper/2408.13461","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:d72c91e35ba63ea4d1cbe4061516fbce9df08644ad548c072a3fdf6f5ed90ad8","observation_id":"647c464e-d2df-49d8-91f6-42febe3974d7","resolution":{"observed_at":"2026-08-07T14:27:06.572513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:06.666118Z","title":"Image-based multimodal models as intruders: Trans- ferable multimodal attacks on video-based mllms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.666118Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:39eb27c3d735e58b67ef039dd0675aca13f470f5c7a9029b5a2de5aa6f6635fd","observation_id":"ddb7fb76-9a77-4eaa-8de0-e4fc68336ab8","resolution":{"observed_at":"2026-08-07T14:27:06.666118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:06.804910Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.804910Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:7b189b5dc2bfbb8d99be887ed5fa5d40b0c48e3240dac415d5f2530e6d525c7b","observation_id":"bf78ab1e-36eb-473a-8bc8-9d1f8f7f2ba8","resolution":{"observed_at":"2026-08-07T14:27:06.804910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.00355","last_updated":"2021-07-27T14:27:27Z","snapshot_observed_at":"2026-07-06T10:55:38.166742Z","submitted_at":"2021-04-01T09:20:33Z","title":"Speech Resynthesis from Discrete Disentangled Self-Supervised Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.00355","snapshot_observed_at":"2026-08-07T14:27:06.919635Z","title":"Speech resynthesis from discrete disentangled self-supervised representations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:06.919635Z"},"links":{"cited_paper":"/paper/2104.00355","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:e4c1518475bd48e1ebb4881baa7dcd0c6f563c51c75562c7c809e4eb5da84f88","observation_id":"3f6c8191-14d5-45c4-8fe3-680a2cd6ff6b","resolution":{"observed_at":"2026-08-07T14:27:06.919635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:07.714101Z","title":"Usage policies,","venue":null,"work_id":"b7de7700-33ed-44e4-915c-e5efa2eb15e9","year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:07.008836Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:1e8bcc8643955376bf8d2390a6c19123ce8617585263ff35e0bf4e242a920c81","observation_id":"fbc169dc-dcb2-48f8-9ee6-c98134c5b063","resolution":{"observed_at":"2026-08-07T14:27:07.794666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09494","last_updated":"2021-04-19T17:56:59Z","snapshot_observed_at":"2026-08-08T00:23:50.082762Z","submitted_at":"2021-04-19T17:56:59Z","title":"NISQA: A Deep CNN-Self-Attention Model for Multidimensional Speech Quality Prediction with Crowdsourced Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09494","snapshot_observed_at":"2026-08-07T14:27:07.110867Z","title":"Nisqa: A deep cnn- self-attention model for multidimensional speech quality prediction with crowdsourced datasets,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:07.110867Z"},"links":{"cited_paper":"/paper/2104.09494","citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:bd926f7e9777247a31b570d04dcbb60a61e477a1bba9e059a5dd198b80974874","observation_id":"acce009c-0393-49ea-a7a9-d118aa8da34c","resolution":{"observed_at":"2026-08-07T14:27:07.110867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:27:07.524749Z","title":"Openai text-to-speech (tts) models,","venue":null,"work_id":"ce0403b5-f908-4e6b-9460-fee8938de5f7","year":2024},"citing_paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:07.201702Z"},"links":{"citing_paper":"/paper/2505.18864"},"observation_digest":"sha256:da04a0c783ffa404d9399aa60d33828f2a61b9d3e3133d33c4cd7e2960e13b38","observation_id":"554ab645-b265-4783-80e9-c56a86c7836a","resolution":{"observed_at":"2026-08-07T14:27:07.597896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.18864","last_updated":"2025-05-24T20:46:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T00:24:14.677549Z","submitted_at":"2025-05-24T20:46:36Z","title":"Audio Jailbreak Attacks: Exposing Vulnerabilities in SpeechGPT in a White-Box Framework"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2505.18864."}