{"as_of":"2026-08-17T14:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7ebcf22cdb92d82d00605e65171a046355a3054401a1aa28f45c97253db2cbad","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:32:35.094736Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T13:17:51.071271Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T13:26:59.313678Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"cited_work":{"arxiv_id":"2505.09602","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09602","snapshot_observed_at":"2026-07-02T13:26:59.313678Z","title":"Adver- sarial suffix filtering: a defense pipeline for llms","venue":null,"work_id":"7cdc40dd-9d37-46c9-98d4-1caaa3e8ebdc","year":2025},"citing_paper":{"arxiv_id":"2605.17288","last_updated":"2026-05-17T06:59:43Z","snapshot_observed_at":"2026-08-15T09:10:37.221931Z","submitted_at":"2026-05-17T06:59:43Z","title":"When Efficiency Backfires: Cascading LLMs Trigger Cascade Failure under Adversarial Attack","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-19T23:58:53.524203Z"},"links":{"cited_paper":"/paper/2505.09602","citing_paper":"/paper/2605.17288"},"observation_digest":"sha256:de0a43f460be2423a2bbdb5869cedee00481b44d85816413bcae4cac9d24f49b","observation_id":"149a16c1-6fc8-49da-ac1a-51837a15be89","resolution":{"observed_at":"2026-05-20T00:02:53.687065Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"cited_work":{"arxiv_id":"2505.09602","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09602","snapshot_observed_at":"2026-07-02T13:26:59.313678Z","title":"Adver- sarial suffix filtering: a defense pipeline for llms","venue":null,"work_id":"7cdc40dd-9d37-46c9-98d4-1caaa3e8ebdc","year":2025},"citing_paper":{"arxiv_id":"2606.05609","last_updated":"2026-06-04T02:31:29Z","snapshot_observed_at":"2026-08-05T14:48:48.513078Z","submitted_at":"2026-06-04T02:31:29Z","title":"SlotGCG: Exploiting the Positional Vulnerability in LLMs for Jailbreak Attacks","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-28T01:16:07.252429Z"},"links":{"cited_paper":"/paper/2505.09602","citing_paper":"/paper/2606.05609"},"observation_digest":"sha256:98c90a9f6abdfe105d2186407c23d55e361d4f503998fcd075c4600b3a71dca8","observation_id":"abdbfdc1-2a74-4658-8510-9419612dd541","resolution":{"observed_at":"2026-07-02T13:26:59.315351Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"cited_work":{"arxiv_id":"2505.09602","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09602","snapshot_observed_at":"2026-07-02T13:26:59.313678Z","title":"Adver- sarial suffix filtering: a defense pipeline for llms","venue":null,"work_id":"7cdc40dd-9d37-46c9-98d4-1caaa3e8ebdc","year":2025},"citing_paper":{"arxiv_id":"2606.30587","last_updated":"2026-06-29T17:31:10Z","snapshot_observed_at":"2026-08-16T13:57:12.392801Z","submitted_at":"2026-06-29T17:31:10Z","title":"Words Speak Louder Than Code: Investigating Cognitive Heuristics in LLM-Based Code Vulnerability Detection","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-30T04:52:35.384665Z"},"links":{"cited_paper":"/paper/2505.09602","citing_paper":"/paper/2606.30587"},"observation_digest":"sha256:8975c04e362e0b4ec25ca55b493fea034957ecc3feae56b667eaef3c37dd4c7b","observation_id":"13d9fd60-149f-42ea-9603-e4a87f41d5e6","resolution":{"observed_at":"2026-06-30T04:54:16.782387Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09602","snapshot_observed_at":"2026-08-02T13:17:51.071271Z","title":"Adversarial suffix filtering: a defense pipeline for llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20472","last_updated":"2026-05-24T05:49:14Z","snapshot_observed_at":"2026-08-03T18:29:39.542542Z","submitted_at":"2026-05-24T05:49:14Z","title":"Robust Critics: Defending LLMs Against Multi-Turn Attacks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T13:17:51.071271Z"},"links":{"cited_paper":"/paper/2505.09602","citing_paper":"/paper/2607.20472"},"observation_digest":"sha256:54aeff1eceb2add19107e6f7d5401eab622dc62ae83138457be0ddccdc70d945","observation_id":"3c30d0be-8b2e-44a3-a29e-12e94e0a7653","resolution":{"observed_at":"2026-08-02T13:17:51.071271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.09602/citation-record","integrity":"/paper/2505.09602/integrity","json":"/paper/2505.09602/citation-record.json","paper":"/paper/2505.09602"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-08-16T14:16:46.139055Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-15T21:32:34.987054Z","title":"A comprehensive study of jailbreak attack versus defense for large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:34.987054Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:806f535be46ea27f7c497a124695336760cb946d920b0ed02a6275a777ae7e71","observation_id":"9672373d-2124-4ca1-bcc8-f8e75c1136c1","resolution":{"observed_at":"2026-08-15T21:32:34.987054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:32:35.430120Z","title":"Llm01:2025 prompt injection, Apr 2025","venue":null,"work_id":"0ecaaa42-202c-486d-96ed-8bb3b4143285","year":2025},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:34.991806Z"},"links":{"citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:1fc846f6d5a1e1621b38b97f1e2f4ffda36691f13211477cbc63e5005cd8caed","observation_id":"0f422e33-8533-47d6-b7a7-1c29d1544b2b","resolution":{"observed_at":"2026-08-15T21:32:35.433836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07921","last_updated":"2024-11-24T18:03:43Z","snapshot_observed_at":"2026-08-16T14:01:39.676116Z","submitted_at":"2024-04-11T17:05:50Z","title":"AmpleGCG: Learning a Universal and Transferable Generative Model of Adversarial Suffixes for Jailbreaking Both Open and Closed LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07921","snapshot_observed_at":"2026-08-15T21:32:34.995516Z","title":"Amplegcg: Learning a universal and transferable generative model of adversarial suffixes for jailbreaking both open and closed llms, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:34.995516Z"},"links":{"cited_paper":"/paper/2404.07921","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:a45581d8078ffa5521f03445300df73468d5abed39333b801666a89d12cda564","observation_id":"748fb07d-0371-4687-9796-952dd541ee81","resolution":{"observed_at":"2026-08-15T21:32:34.995516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-15T21:32:34.999281Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:34.999281Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:4fa729896ff98cb5cd66adb99a8ea65d24856f7559aef99e0049db8e9f5f10f3","observation_id":"3653e94c-c99b-491f-bc7a-23122575d2f6","resolution":{"observed_at":"2026-08-15T21:32:34.999281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:32:35.419721Z","title":"Segment any text: A universal approach for robust, efficient and adaptable sentence segmentation","venue":null,"work_id":"59681caa-0533-4383-bdcb-893d7f2571e5","year":2024},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.003512Z"},"links":{"citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:7693a456e79faaa4ff79b3f937ec2631f4369b44e87794ac01449a56d70e0fc8","observation_id":"5cca18e6-8eae-4798-8b41-8b96311e0aee","resolution":{"observed_at":"2026-08-15T21:32:35.423493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-15T21:32:35.007373Z","title":"BERT: pre-training of deep bidirectional transformers for language understanding.CoRR, abs/1810.04805, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.007373Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:5183e151fde2238682eee241d756f7d11cfcd072f05787328af24154fa3c543b","observation_id":"d3794bae-4d30-4f7c-8d80-6cb247cf57b5","resolution":{"observed_at":"2026-08-15T21:32:35.007373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02705","last_updated":"2025-02-04T19:47:09Z","snapshot_observed_at":"2026-08-16T15:02:58.647281Z","submitted_at":"2023-09-06T04:37:20Z","title":"Certifying LLM Safety against Adversarial Prompting","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02705","snapshot_observed_at":"2026-08-15T21:32:35.011638Z","title":"Certifying llm safety against adversarial prompting, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.011638Z"},"links":{"cited_paper":"/paper/2309.02705","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:41b40ebd215b804912ba6cbccba83f41245ce3e6045640d3ee52e3829d8c9300","observation_id":"7d8eba85-300b-4352-9b4e-9cf80184c1d6","resolution":{"observed_at":"2026-08-15T21:32:35.011638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.06083","last_updated":"2019-09-04T18:53:10Z","snapshot_observed_at":"2026-08-07T14:27:46.872660Z","submitted_at":"2017-06-19T17:53:11Z","title":"Towards Deep Learning Models Resistant to Adversarial Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.06083","snapshot_observed_at":"2026-08-15T21:32:35.015375Z","title":"Towards deep learning models resistant to adversarial attacks, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.015375Z"},"links":{"cited_paper":"/paper/1706.06083","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:9188f59ce39bd5ddc07d83e7eb1b30960da680553e977aa27f28d41bc3e43754","observation_id":"68da643a-3549-496f-b972-405019b906f3","resolution":{"observed_at":"2026-08-15T21:32:35.015375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15042","last_updated":"2024-10-19T08:57:35Z","snapshot_observed_at":"2026-08-16T13:07:49.274255Z","submitted_at":"2024-10-19T08:57:35Z","title":"Adversarial Training: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15042","snapshot_observed_at":"2026-08-15T21:32:35.019242Z","title":"Adversarial training: A survey, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.019242Z"},"links":{"cited_paper":"/paper/2410.15042","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:e6924c65c274d4b271fed232b2ff220252bce56b3a2ca43a4aeed6a5fea38b7f","observation_id":"0c449067-1b3b-4579-b62c-c68792d5507b","resolution":{"observed_at":"2026-08-15T21:32:35.019242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15589","last_updated":"2024-11-01T16:39:36Z","snapshot_observed_at":"2026-08-16T13:49:43.562561Z","submitted_at":"2024-05-24T14:20:09Z","title":"Efficient Adversarial Training in LLMs with Continuous Attacks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15589","snapshot_observed_at":"2026-08-15T21:32:35.023227Z","title":"Efficient adversarial training in llms with continuous attacks, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.023227Z"},"links":{"cited_paper":"/paper/2405.15589","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:18fc5442649f7dc42cd79e9c04b8607efc6b8f92986293aa99ef31e3e7ab39c2","observation_id":"5e7f85de-d2f6-459e-873a-bd3df7ed1fc5","resolution":{"observed_at":"2026-08-15T21:32:35.023227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20089","last_updated":"2025-03-20T15:28:18Z","snapshot_observed_at":"2026-08-16T13:14:12.950870Z","submitted_at":"2024-09-30T08:41:39Z","title":"Robust LLM safeguarding via refusal feature adversarial training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20089","snapshot_observed_at":"2026-08-15T21:32:35.026829Z","title":"Robust llm safeguarding via refusal feature adversarial training, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.026829Z"},"links":{"cited_paper":"/paper/2409.20089","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:495facdc45f9e7af6d3d5ff4c4588a828787f3d3b7a63252248f54f88f25125f","observation_id":"fc0ff1a2-5a98-4988-b104-25f91b3289b9","resolution":{"observed_at":"2026-08-15T21:32:35.026829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06176","last_updated":"2024-03-05T05:18:54Z","snapshot_observed_at":"2026-08-16T15:34:24.581660Z","submitted_at":"2023-05-09T17:06:06Z","title":"Fine-tuning Language Models with Generative Adversarial Reward Modelling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06176","snapshot_observed_at":"2026-08-15T21:32:35.030666Z","title":"Fine-tuning language models with generative adversarial reward modelling, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.030666Z"},"links":{"cited_paper":"/paper/2305.06176","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:9e2ca0b694287d122c8b1a748f11191b79f8ba77d8396a8479bc70c86aeb2f29","observation_id":"db22b0bd-e267-4afb-a91c-c15a05bf232e","resolution":{"observed_at":"2026-08-15T21:32:35.030666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06363","last_updated":"2024-09-25T19:48:39Z","snapshot_observed_at":"2026-08-16T14:19:54.814069Z","submitted_at":"2024-02-09T12:15:51Z","title":"StruQ: Defending Against Prompt Injection with Structured Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06363","snapshot_observed_at":"2026-08-15T21:32:35.034365Z","title":"Struq: Defending against prompt injection with structured queries, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.034365Z"},"links":{"cited_paper":"/paper/2402.06363","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:f6ca8dd1e568906427bdb7793db965dbb68a4beabc7e2b85bba735fbff7068e3","observation_id":"b9333def-0361-4692-a91d-606c1842f185","resolution":{"observed_at":"2026-08-15T21:32:35.034365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08983","last_updated":"2024-07-25T22:59:44Z","snapshot_observed_at":"2026-08-16T14:18:44.958632Z","submitted_at":"2024-02-14T06:54:31Z","title":"SafeDecoding: Defending against Jailbreak Attacks via Safety-Aware Decoding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08983","snapshot_observed_at":"2026-08-15T21:32:35.038618Z","title":"Safedecoding: Defending against jailbreak attacks via safety-aware decoding, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.038618Z"},"links":{"cited_paper":"/paper/2402.08983","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:7ed44d9e1a7b96e68e1a5dc12974cebb93d96baa205536dfe969fd30da7d59ab","observation_id":"43e3a7e8-dff9-442d-a31f-8b6fade67291","resolution":{"observed_at":"2026-08-15T21:32:35.038618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14233","last_updated":"2023-05-23T16:49:14Z","snapshot_observed_at":"2026-08-14T22:24:15.551461Z","submitted_at":"2023-05-23T16:49:14Z","title":"Enhancing Chat Language Models by Scaling High-quality Instructional Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14233","snapshot_observed_at":"2026-08-15T21:32:35.042554Z","title":"Enhancing chat language models by scaling high-quality instructional conversations, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.042554Z"},"links":{"cited_paper":"/paper/2305.14233","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:33a6bc6becc2e9393e7a07d6d0b060918c454d9217becfceef9b306af64f398a","observation_id":"215f0602-dcbb-4f91-a6a3-695604c95c93","resolution":{"observed_at":"2026-08-15T21:32:35.042554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-15T21:32:35.046094Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.046094Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:87a8d92432f5060c154b54c82403d71c413e3ffa9bb27a671d93f06a0628a1b2","observation_id":"b9eb8ed9-1139-4d70-80f9-b6604ffaa5ee","resolution":{"observed_at":"2026-08-15T21:32:35.046094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00029","last_updated":"2024-08-18T22:26:13Z","snapshot_observed_at":"2026-08-16T14:42:47.841549Z","submitted_at":"2023-11-16T07:31:18Z","title":"Bergeron: Combating Adversarial Attacks through a Conscience-Based Alignment Framework","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00029","snapshot_observed_at":"2026-08-15T21:32:35.049834Z","title":"Bergeron: Combating adversarial attacks through a conscience-based alignment framework, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.049834Z"},"links":{"cited_paper":"/paper/2312.00029","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:dc5fc336feb4eb5f6d800ac723b2588ca182ea9d93c6827755c62b39909a9a92","observation_id":"42ac8c90-73cd-4576-a87d-4b9e99366f39","resolution":{"observed_at":"2026-08-15T21:32:35.049834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-08-14T15:42:19.849118Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-15T21:32:35.053550Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.053550Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:149124c4ffe250a3b1f1658867943dea1f6ff873328143e756d4a46d2e3baf57","observation_id":"08f47364-eb2f-4d91-93ee-c4c81d8e36c6","resolution":{"observed_at":"2026-08-15T21:32:35.053550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14132","last_updated":"2023-11-07T03:30:15Z","snapshot_observed_at":"2026-08-15T21:55:47.604051Z","submitted_at":"2023-08-27T15:20:06Z","title":"Detecting Language Model Attacks with Perplexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14132","snapshot_observed_at":"2026-08-15T21:32:35.057127Z","title":"Detecting language model attacks with perplexity, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.057127Z"},"links":{"cited_paper":"/paper/2308.14132","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:a22b6e3539a5e30500495b843d801d81c9f3e7c7f39e281523087376f23ec010","observation_id":"06af661b-a81c-4f52-a412-300a2d976d40","resolution":{"observed_at":"2026-08-15T21:32:35.057127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-15T21:32:35.060849Z","title":"Baseline defenses for adversarial attacks against aligned language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.060849Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:df3851bf5103667fdd39599c1ae0216ef443055ec2002b568e51f7689c8e1163","observation_id":"4f57d49e-b0e2-4f83-a6aa-2d1f3a372529","resolution":{"observed_at":"2026-08-15T21:32:35.060849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:32:35.064483Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.064483Z"},"links":{"citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:95760b0bc64ca48066f08598468bbecda58325c82ce2f7b510d0704aa919952b","observation_id":"e4c778d1-ec3d-4b31-bc9d-29703b9c7da5","resolution":{"observed_at":"2026-08-15T21:32:35.064483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22143","last_updated":"2024-10-29T15:40:07Z","snapshot_observed_at":"2026-08-16T13:04:55.427903Z","submitted_at":"2024-10-29T15:40:07Z","title":"AmpleGCG-Plus: A Strong Generative Model of Adversarial Suffixes to Jailbreak LLMs with Higher Success Rates in Fewer Attempts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22143","snapshot_observed_at":"2026-08-15T21:32:35.067969Z","title":"Amplegcg-plus: A strong generative model of adversarial suffixes to jailbreak llms with higher success rates in fewer attempts, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.067969Z"},"links":{"cited_paper":"/paper/2410.22143","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:0b2f03d3ee38e82aa3a64885aacfe68523926344371b2d22e8834aa87f300b7f","observation_id":"d8d3328e-e1f8-4129-8ada-839bbac22144","resolution":{"observed_at":"2026-08-15T21:32:35.067969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:32:35.071789Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.071789Z"},"links":{"citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:d913329bd0e8c291871712dea13da84ada74d9074fbd4e7aef1c034404ba902d","observation_id":"447eb956-c90b-4bca-b7bd-cb34e5dda05a","resolution":{"observed_at":"2026-08-15T21:32:35.071789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06987","last_updated":"2023-10-10T20:15:54Z","snapshot_observed_at":"2026-08-15T18:47:46.763989Z","submitted_at":"2023-10-10T20:15:54Z","title":"Catastrophic Jailbreak of Open-source LLMs via Exploiting Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06987","snapshot_observed_at":"2026-08-15T21:32:35.075343Z","title":"Catastrophic jailbreak of open-source llms via exploiting generation.arXiv preprint arXiv:2310.06987, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.075343Z"},"links":{"cited_paper":"/paper/2310.06987","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:aa82423f255a5cf8edfa5681f640206f9522ae4352c49e2965bf907651635f4a","observation_id":"e4b30abc-8ed8-4425-85f4-2d62a287d915","resolution":{"observed_at":"2026-08-15T21:32:35.075343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-08-16T09:07:20.265665Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-15T21:32:35.078942Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal.arXiv preprint arXiv:2402.04249, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.078942Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:ac0d5b5bed1ed5b6b44ddf07b4ef5e08b41a1b15d6dece1bcc587fe450f9a084","observation_id":"6adaa47e-42d9-4dcf-b9df-e43746716f58","resolution":{"observed_at":"2026-08-15T21:32:35.078942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:32:35.082718Z","title":"The language model evaluation harness, 07 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.082718Z"},"links":{"citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:636f9bf725d36e3c9207c1b3e076c7408761ab41a5b512e5d7319752a0041111","observation_id":"838ff448-ce1e-488a-bd6f-d00cda66142b","resolution":{"observed_at":"2026-08-15T21:32:35.082718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:32:35.086165Z","title":"The art of defending: A systematic evaluation and analysis of LLM defense strategies on safety and over-defensiveness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.086165Z"},"links":{"citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:fab6cb00c6fd9ed996ee4b6d5fe6b86828235fdaa0986f9597f2157e4a89949f","observation_id":"b8d89fc6-b39e-45fc-894f-f318517b86e4","resolution":{"observed_at":"2026-08-15T21:32:35.086165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:32:35.396822Z","title":"Limitations","venue":null,"work_id":"87c6ad40-d3ba-474c-93e9-e94a869da869","year":1990},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.089899Z"},"links":{"citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:7ed50973cb87d551904b42ca7afbeb444f41453389cdbcbf163682741b675bc3","observation_id":"447dab16-63d3-4535-8835-7c90c9826d61","resolution":{"observed_at":"2026-08-15T21:32:35.400368Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:32:35.384118Z","title":"Guidelines: • The answer NA means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":"c5c7e055-0027-4d1a-b6f9-e83796254204","year":2025},"citing_paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T21:32:35.094736Z"},"links":{"citing_paper":"/paper/2505.09602"},"observation_digest":"sha256:3badfe25aefda6d492fc7ce8d89216df36a2de2df1c291b632f92b6da11144a2","observation_id":"b241e1a0-e37b-4f19-adc7-68f81af1c3d4","resolution":{"observed_at":"2026-08-15T21:32:35.389715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.09602","last_updated":"2025-05-14T17:52:10Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T13:56:26.874876Z","submitted_at":"2025-05-14T17:52:10Z","title":"Adversarial Suffix Filtering: a Defense Pipeline for LLMs"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 4 inbound Pith citation observations for arXiv:2505.09602."}