{"as_of":"2026-08-10T18:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:57ea45e33e4c6aae67535083d0d8e546f8107b77c134481c49d5ee9709d05366","coverage":[{"denominator":95,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":95,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T10:29:50.362918Z","state":"measured"},{"denominator":97,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":97,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:35:02.934856Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T00:35:04.587765Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"cited_work":{"arxiv_id":"2502.02960","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.02960","snapshot_observed_at":"2026-08-07T00:35:04.587765Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","venue":"cs.CR","work_id":"8d9003d8-fe86-4c3b-aa71-14491fbf1c40","year":2025},"citing_paper":{"arxiv_id":"2506.13434","last_updated":"2025-06-16T12:52:19Z","snapshot_observed_at":"2026-08-09T06:40:11.738919Z","submitted_at":"2025-06-16T12:52:19Z","title":"From Promise to Peril: Rethinking Cybersecurity Red and Blue Teaming in the Age of LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:35:02.934856Z"},"links":{"cited_paper":"/paper/2502.02960","citing_paper":"/paper/2506.13434"},"observation_digest":"sha256:9fd34d4893ad4568b7d5f8258ae25158cfdc3d2a0ba065ad25182607f3789105","observation_id":"2842c79c-6be7-423f-b77f-7b35afa6b67b","resolution":{"observed_at":"2026-08-07T00:35:04.696552Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02960","snapshot_observed_at":"2026-08-03T13:15:39.492454Z","title":"Wang, N., Walter, K., Gao, Y ., and Abuadbba, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.00065","last_updated":"2026-05-28T08:57:38Z","snapshot_observed_at":"2026-08-03T13:15:33.561981Z","submitted_at":"2025-12-31T19:00:03Z","title":"When the Same Coefficients Reach Different Places: Asymmetric Realizability in Transplanting Tokenizers across Large Language Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T13:15:39.492454Z"},"links":{"cited_paper":"/paper/2502.02960","citing_paper":"/paper/2601.00065"},"observation_digest":"sha256:7f74705b06b5678eda04c78c91ee5abdb09eddfae2cef92287cb80df712093cb","observation_id":"5871a68c-3751-433f-b1e5-514cd21ddd3b","resolution":{"observed_at":"2026-08-03T13:15:39.492454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.02960/citation-record","integrity":"/paper/2502.02960/integrity","json":"/paper/2502.02960/citation-record.json","paper":"/paper/2502.02960"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.878963Z","title":"Quantifying privacy risks of masked language models using membership inference attacks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.878963Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:b8914b14457c877d3ca44afad1204a8449d5c57c2499929a5d655be33602edbc","observation_id":"779a59b4-5326-4312-a74a-dfff88d743dc","resolution":{"observed_at":"2026-08-09T10:29:49.878963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.885274Z","title":"An empirical analysis of memorization in fine-tuned autoregressive language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.885274Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:f81b22643a3fec04f02d4e5a2679e6b47da660309be7891f6a41e7a55ab4e7ad","observation_id":"41c3239e-1410-4ea5-999e-b275f1534e11","resolution":{"observed_at":"2026-08-09T10:29:49.885274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18462","last_updated":"2023-08-07T06:32:56Z","snapshot_observed_at":"2026-07-06T15:34:59.457879Z","submitted_at":"2023-05-29T07:06:03Z","title":"Membership Inference Attacks against Language Models via Neighbourhood Comparison","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18462","snapshot_observed_at":"2026-08-09T10:29:49.890895Z","title":"Membership inference attacks against language models via neighbourhood comparison,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.890895Z"},"links":{"cited_paper":"/paper/2305.18462","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:d2ee09dce8bf4320904acab12ec284659fe1a6e4811c6e1923732f2a1660ac94","observation_id":"dcdf25c0-2c7a-41ff-93e9-29138a8dfd55","resolution":{"observed_at":"2026-08-09T10:29:49.890895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06062","last_updated":"2024-11-26T03:19:15Z","snapshot_observed_at":"2026-08-10T09:25:53.294934Z","submitted_at":"2023-11-10T13:55:05Z","title":"Practical Membership Inference Attacks against Fine-tuned Large Language Models via Self-prompt Calibration","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06062","snapshot_observed_at":"2026-08-09T10:29:49.897327Z","title":"Practical membership inference attacks against fine-tuned large language models via self-prompt calibration,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.897327Z"},"links":{"cited_paper":"/paper/2311.06062","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:d7523e6231e5f2f6bdb763c12a00be91a0edf98acaa8b14f839d4ea6b1d05153","observation_id":"9deaa668-e970-4dd3-b7da-9a0082b88612","resolution":{"observed_at":"2026-08-09T10:29:49.897327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.13733","last_updated":"2021-04-15T17:43:43Z","snapshot_observed_at":"2026-07-06T11:04:24.086263Z","submitted_at":"2021-04-15T17:43:43Z","title":"Gradient-based Adversarial Attacks against Text Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.13733","snapshot_observed_at":"2026-08-09T10:29:49.903229Z","title":"Gradient-based adversarial attacks against text transformers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.903229Z"},"links":{"cited_paper":"/paper/2104.13733","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:0b843372e14cc2784c1e4101df52d8dafd9234bb6de98ebb39b256f18ff52a1d","observation_id":"f2c40a2f-82de-4342-ae64-a7ef4823dfda","resolution":{"observed_at":"2026-08-09T10:29:49.903229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04237","last_updated":"2023-05-29T17:06:45Z","snapshot_observed_at":"2026-08-09T19:28:46.592382Z","submitted_at":"2023-02-08T18:07:31Z","title":"Black Box Adversarial Prompting for Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04237","snapshot_observed_at":"2026-08-09T10:29:49.909350Z","title":"Black box adversarial prompting for foundation models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.909350Z"},"links":{"cited_paper":"/paper/2302.04237","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:39ede9f983365320fa300be36063dac0f8988f1a24c376d9ee72562461b8df61","observation_id":"cbb59246-0ea7-46db-b807-bf6652108343","resolution":{"observed_at":"2026-08-09T10:29:49.909350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.915885Z","title":"Sponge examples: Energy-latency attacks on neural networks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.915885Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:d164583cbb15113e78fb70e3879022c625b90fc5627706bd9ba8631c4f6f3bbb","observation_id":"db709750-b4c6-428b-b5ae-aa3f11dbd7d3","resolution":{"observed_at":"2026-08-09T10:29:49.915885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.921380Z","title":"The skipsponge attack: Sponge weight poisoning of deep neural networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.921380Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:5fc5c72e6f5bb085848f7608f68b1475fc82ff5d6ff5abb642453f8ded791b09","observation_id":"fe2f31d1-204c-45db-87c1-7d02a2b0d420","resolution":{"observed_at":"2026-08-09T10:29:49.921380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00083","last_updated":"2024-06-06T13:38:42Z","snapshot_observed_at":"2026-08-10T01:34:02.862915Z","submitted_at":"2024-06-03T02:25:33Z","title":"BadRAG: Identifying Vulnerabilities in Retrieval Augmented Generation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00083","snapshot_observed_at":"2026-08-09T10:29:49.926458Z","title":"Badrag: Identifying vulnerabilities in retrieval augmented generation of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.926458Z"},"links":{"cited_paper":"/paper/2406.00083","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:201e7161da53e9936df2125e3d0411ee90a838a7e71dc5da9c5db5b708ceb1ee","observation_id":"6a777596-80af-48c8-b0b4-4dfd32229065","resolution":{"observed_at":"2026-08-09T10:29:49.926458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.931875Z","title":"Not what you’ve signed up for: Compromising real- world llm-integrated applications with indirect prompt injection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.931875Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:f8516ef035d308d2f3b5db21858110422f3c15e86c13943da891e4f197f7d6c0","observation_id":"995d862d-9357-4648-b6aa-9b2beed85019","resolution":{"observed_at":"2026-08-09T10:29:49.931875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.937164Z","title":"Jailbroken: How does llm safety training fail?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.937164Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:0997b32019ba1b926766e44c3cf853a2404ac70cb1b83c6896b204bfee6ec811","observation_id":"92087abb-dcb0-4cf1-aaf2-c880a8bcdce5","resolution":{"observed_at":"2026-08-09T10:29:49.937164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.942178Z","title":"Masterkey: Automated jailbreaking of large language model chatbots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.942178Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:00b7e051d440bcec98bca7e632d872726c8c2dd57c89a074fe456b091ac63277","observation_id":"bca425bf-1acb-4d80-841d-c3fd08864da5","resolution":{"observed_at":"2026-08-09T10:29:49.942178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.947217Z","title":"Low-resource lan- guages jailbreak gpt-4,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.947217Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:a61f8e01227f310c1f0cdd827713c179726cea09c833d1fe6646298fc0db82b6","observation_id":"aebabad7-a43b-4edd-9f45-f7b5f7d9ac9c","resolution":{"observed_at":"2026-08-09T10:29:49.947217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.952312Z","title":"RRHF: rank responses to align language models with human feedback,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.952312Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:23a0b7485534c7466592a5f7271a7160f18d7e6a95561f32602a4405c3bd1922","observation_id":"1b9bcac8-9ae9-4525-9a19-bd95db159a94","resolution":{"observed_at":"2026-08-09T10:29:49.952312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00888","last_updated":"2024-11-14T22:20:49Z","snapshot_observed_at":"2026-07-06T17:23:55.166594Z","submitted_at":"2024-01-30T04:00:54Z","title":"Security and Privacy Challenges of Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00888","snapshot_observed_at":"2026-08-09T10:29:49.957573Z","title":"Security and privacy challenges of large language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.957573Z"},"links":{"cited_paper":"/paper/2402.00888","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:d8ca41553417fdb8b19820d94da72d435bfc206443a7bfa019f21ef3af1c64b2","observation_id":"fd0a7d43-5122-4bbc-b63a-2a756102bda9","resolution":{"observed_at":"2026-08-09T10:29:49.957573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.962958Z","title":"Unique security and privacy threats of large language model: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.962958Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:82c5154402515e0b1a6b5dcb4602cb33f564a49e046bb5e95fcf5eb87dd171c8","observation_id":"b0378fa5-1859-43d7-895a-17e2b22223bb","resolution":{"observed_at":"2026-08-09T10:29:49.962958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10844","last_updated":"2023-10-16T21:37:24Z","snapshot_observed_at":"2026-08-07T21:21:24.962049Z","submitted_at":"2023-10-16T21:37:24Z","title":"Survey of Vulnerabilities in Large Language Models Revealed by Adversarial Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10844","snapshot_observed_at":"2026-08-09T10:29:49.967993Z","title":"Survey of vulnerabilities in large language models revealed by adversarial attacks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.967993Z"},"links":{"cited_paper":"/paper/2310.10844","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:963849b078156486153e06348c96b4900f6f14495b69b870dc223d95be49af1f","observation_id":"02ad21f5-47e0-411d-a5f6-8f19eb505419","resolution":{"observed_at":"2026-08-09T10:29:49.967993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.973357Z","title":"Breaking down the defenses: A comparative survey of attacks on large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.973357Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:e13f9209325d84f677c25e313af525bf5144d68aa0a32c7d43bfb29fc3728db7","observation_id":"65153636-eaff-4879-b51d-f68063d5b45d","resolution":{"observed_at":"2026-08-09T10:29:49.973357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.978509Z","title":"A survey on large language model (llm) security and privacy: The good, the bad, and the ugly,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.978509Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:b50c5d0542ffbcd4890b96b5e3f045852bed542eb92d305322abafbfd81e13f6","observation_id":"a8d434f7-f535-4237-b046-cd1225ee0d1a","resolution":{"observed_at":"2026-08-09T10:29:49.978509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01231","last_updated":"2024-04-01T16:50:54Z","snapshot_observed_at":"2026-08-09T22:32:11.520389Z","submitted_at":"2024-04-01T16:50:54Z","title":"Privacy Backdoors: Enhancing Membership Inference through Poisoning Pre-trained Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01231","snapshot_observed_at":"2026-08-09T10:29:49.983629Z","title":"Privacy backdoors: Enhancing membership inference through poisoning pre-trained models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.983629Z"},"links":{"cited_paper":"/paper/2404.01231","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:110bcbf65000aa83ad2e5ed46306d412e50e2f28a523bebfe0ed2ad105a526ad","observation_id":"4cb37f0c-3d15-4aca-9a81-eb28e3e36c64","resolution":{"observed_at":"2026-08-09T10:29:49.983629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05610","last_updated":"2024-07-18T08:12:46Z","snapshot_observed_at":"2026-07-06T16:17:00.299422Z","submitted_at":"2023-09-11T16:49:05Z","title":"Privacy Side Channels in Machine Learning Systems","version":2},"cited_work":{"arxiv_id":"2309.05610","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.05610","snapshot_observed_at":"2026-08-09T10:29:51.306562Z","title":"Privacy Side Channels in Machine Learning Systems","venue":"cs.CR","work_id":"d73a47a9-97fd-45d2-895e-8a59da441fe6","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.988800Z"},"links":{"cited_paper":"/paper/2309.05610","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:a041268dd636eae07c4c7d3e43a46f10bcccda6c82ae968ec5e8951105b0bc25","observation_id":"e8a8fa1d-2984-4f45-bdd1-d2a2ad54f320","resolution":{"observed_at":"2026-08-09T10:29:51.313274Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.994381Z","title":"Extracting training data from large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.994381Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:5a6fa055ab3ce741ea3772f4e623d3121a6ebb07722e1902c922a0e00c1ab084","observation_id":"3f72908d-90ab-427c-8799-5dc8b064bdf1","resolution":{"observed_at":"2026-08-09T10:29:49.994381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04401","last_updated":"2023-07-10T08:03:41Z","snapshot_observed_at":"2026-07-06T15:52:01.837079Z","submitted_at":"2023-07-10T08:03:41Z","title":"Ethicist: Targeted Training Data Extraction Through Loss Smoothed Soft Prompting and Calibrated Confidence Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04401","snapshot_observed_at":"2026-08-09T10:29:50.004481Z","title":"Ethicist: Targeted training data extraction through loss smoothed soft prompting and calibrated confidence estimation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.004481Z"},"links":{"cited_paper":"/paper/2307.04401","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:f5b0353ee8bd2279e9efca0aacf0ab622edde35aacc6deed8be363d926cb6283","observation_id":"e7a9df9f-6b17-49af-a957-e5366528a70c","resolution":{"observed_at":"2026-08-09T10:29:50.004481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08935","last_updated":"2019-12-19T05:09:29Z","snapshot_observed_at":"2026-08-10T14:40:00.659950Z","submitted_at":"2019-06-21T03:46:43Z","title":"Deep Leakage from Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08935","snapshot_observed_at":"2026-08-09T10:29:50.009850Z","title":"Deep leakage from gradients,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.009850Z"},"links":{"cited_paper":"/paper/1906.08935","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:48de48ece9a70f8b69f82127fc442f6d2b453da2cef291ee6f20190c8ea6d6ca","observation_id":"89257ba0-bdc9-4ab2-9738-27bcfce1e6bf","resolution":{"observed_at":"2026-08-09T10:29:50.009850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13624","last_updated":"2023-11-22T09:58:01Z","snapshot_observed_at":"2026-07-06T16:51:15.252642Z","submitted_at":"2023-11-22T09:58:01Z","title":"A Theoretical Insight into Attack and Defense of Gradient Leakage in Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13624","snapshot_observed_at":"2026-08-09T10:29:50.014690Z","title":"A theoretical insight into attack and defense of gradient leakage in transformer,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.014690Z"},"links":{"cited_paper":"/paper/2311.13624","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:65ed6ce1d7012933152301c1c05db276530cdd565b8aede8183368e126c56f3a","observation_id":"3d54ee97-8d13-4b2e-86df-9874747309ee","resolution":{"observed_at":"2026-08-09T10:29:50.014690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:50.020105Z","title":"Model leeching: An extraction attack targeting llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.020105Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:0336162acee8ea73e6be4f603880382ca6477f311e265cfcae1a7c2e1b5a9d8d","observation_id":"3efd2ac7-ff19-44dc-b02a-9eb1a30ea79b","resolution":{"observed_at":"2026-08-09T10:29:50.020105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:50.025185Z","title":"Prompt injection attack against llm-integrated applications,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.025185Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:1138a432f9c7b1adb986e2b3dfb170e7bf6616fc8c9d4844df1155d1c7700c71","observation_id":"96360e29-b26d-409c-9855-b0c13b2a0746","resolution":{"observed_at":"2026-08-09T10:29:50.025185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06865","last_updated":"2024-08-07T22:05:01Z","snapshot_observed_at":"2026-08-07T22:01:02.608714Z","submitted_at":"2023-07-13T16:15:08Z","title":"Effective Prompt Extraction from Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06865","snapshot_observed_at":"2026-08-09T10:29:50.030145Z","title":"Effective prompt extraction from language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.030145Z"},"links":{"cited_paper":"/paper/2307.06865","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:8694ce107bb8e6025d45c7e11130c7eec996c9bcf7d4bc5fb14f6edf2f29d25e","observation_id":"fe3e80c8-957a-4412-8773-ea7dc1347c39","resolution":{"observed_at":"2026-08-09T10:29:50.030145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15469","last_updated":"2024-07-26T04:43:19Z","snapshot_observed_at":"2026-08-06T07:43:03.020754Z","submitted_at":"2023-10-24T02:48:19Z","title":"The Janus Interface: How Fine-Tuning in Large Language Models Amplifies the Privacy Risks","version":3},"cited_work":{"arxiv_id":"2310.15469","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.15469","snapshot_observed_at":"2026-08-09T10:29:51.191854Z","title":"The Janus Interface: How Fine-Tuning in Large Language Models Amplifies the Privacy Risks","venue":"cs.CR","work_id":"6dcf4649-88d8-4018-a2a7-6e8d3706b938","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.035282Z"},"links":{"cited_paper":"/paper/2310.15469","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:aee66a05343b43d1412cc0da19e1e2ac88fc577007ba443be0a21900d29f0623","observation_id":"5842d16d-8d1f-44c5-8227-e936ab9139c8","resolution":{"observed_at":"2026-08-09T10:29:51.199889Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:50.040248Z","title":"Multi-step jailbreaking privacy attacks on chatgpt,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.040248Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:6a0efc435217450d853a837e0e3f1417897abd059bac0760aa0268067bf06873","observation_id":"ed4d8bc0-5d0e-453a-a005-c4ff380858a5","resolution":{"observed_at":"2026-08-09T10:29:50.040248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.578845Z","title":"Badpre: Task-agnostic backdoor attacks to pre-trained NLP foun- dation models,","venue":null,"work_id":"f777a79a-cce0-4d13-be61-c0c31fc1117f","year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.050488Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:5507d32a71ccb8845e2178c66ec2ad8b3041627fcf6398cab8de1bb379de2345","observation_id":"dfd102d3-7ad6-470d-83af-2846c683e55c","resolution":{"observed_at":"2026-08-09T10:29:52.584283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.563641Z","title":"Composite backdoor attacks against large language models,","venue":null,"work_id":"2abcf6d9-43c2-43c8-ae9d-351e261d0315","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.055190Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:20cc73859a9f248e28c1b8b4f2ebb687a4df7bb933ed0ce3f31299819df1778a","observation_id":"6c1c5dfa-d7aa-4dae-98b4-bd5b4200e3d0","resolution":{"observed_at":"2026-08-09T10:29:52.568430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.547819Z","title":"Backdoor attacks for in-context learning with language models,","venue":null,"work_id":"14ded355-5464-41ad-b1f1-e41bd2682013","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.060127Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:e2a985c8ebf5d5b7a5ad3ef1a5b7d9637e8a8133972e92b6516c7746fe05ec83","observation_id":"bd0f4184-31b1-470a-ba8c-b7416d6c0bde","resolution":{"observed_at":"2026-08-09T10:29:52.553102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.530932Z","title":"Badedit: Backdooring large language models by model editing,","venue":null,"work_id":"1fcbeaf0-81aa-4460-ba78-279b5552d00b","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.065116Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:79468f66abcd6c6aa487a3051ae0073c4b94224377a459c8bbb77ff15d187a59","observation_id":"b5afd884-a4f8-484e-8681-bada0c27234f","resolution":{"observed_at":"2026-08-09T10:29:52.536460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.511945Z","title":"Weight poisoning attacks on pretrained models,","venue":null,"work_id":"da050637-7ad3-453a-b399-5de9fa3fc349","year":2020},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.069622Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:413f8a52032e7557a507a9f4d7d73e3f1baa1fa5c8796dceed5005de7be47ebb","observation_id":"104c0c6c-0a95-439d-98bc-f0ac8b3441a0","resolution":{"observed_at":"2026-08-09T10:29:52.517375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.493359Z","title":"Backdoor attacks on pre-trained models by layerwise weight poisoning,","venue":null,"work_id":"487099a6-40cd-44c6-87ea-3f6fd87db79e","year":2021},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.075006Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:195660190ffb8813a1ee4d1e20f0d05996875fc4a7162dd94b5d6231e76fe8a6","observation_id":"5c2fce5d-2772-4ab2-a49d-841329a74b9c","resolution":{"observed_at":"2026-08-09T10:29:52.498615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.477112Z","title":"Catastrophic interference in con- nectionist networks: The sequential learning problem,","venue":null,"work_id":"9b075254-e398-4937-8157-172efa59fed6","year":1989},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.079789Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:c6d8a13c7e8e7b1730a2a43a4ae7215a7dbb8080818528c25671d71148405a0e","observation_id":"e8c064ac-2385-4a54-81c3-531e019f7bbb","resolution":{"observed_at":"2026-08-09T10:29:52.482663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.460246Z","title":"Red alarm for pre-trained models: Universal vul- nerability to neuron-level backdoor attacks,","venue":null,"work_id":"d3ed1417-0ab4-40c5-9aec-edd6885ea0f8","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.084616Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:f2173e21d36e22ba470298196e1b65ce2f22ffa362f5318190a234e2e41ed37c","observation_id":"4834bdd4-b249-44f7-acb6-b65eeecd8104","resolution":{"observed_at":"2026-08-09T10:29:52.465334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.445037Z","title":"Uor: Universal backdoor attacks on pre-trained language models,","venue":null,"work_id":"d47f23e6-ea9c-46ee-9fc5-e8a49f174f91","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.089493Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:4e4a4f190f43127f35cc6c80952d604f4108836334387af50cbb094b1fc07a93","observation_id":"0ec9a2fd-054a-4cba-b80c-12034ffe5170","resolution":{"observed_at":"2026-08-09T10:29:52.450065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09251","last_updated":"2022-12-19T05:13:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-19T05:13:52Z","title":"Discovering Language Model Behaviors with Model-Written Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09251","snapshot_observed_at":"2026-08-09T10:29:50.094426Z","title":"Discovering language model behaviors with model-written evaluations,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.094426Z"},"links":{"cited_paper":"/paper/2212.09251","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:06eb99bd2be66520b3ba74a05d09f00bfcd40d4ea0bb0d8d9fa09ec97f580275","observation_id":"742eb058-6c6b-4ead-8bed-ff69863269af","resolution":{"observed_at":"2026-08-09T10:29:50.094426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-09T10:29:50.099679Z","title":"Explaining and harnessing adversarial examples,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.099679Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:3596efaea8cac461785faa776d7fd22a18bd6f95575584c94d24fc821662a913","observation_id":"4c8e2cb1-216d-46e0-b20f-70989f7e1828","resolution":{"observed_at":"2026-08-09T10:29:50.099679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:50.104633Z","title":"Universal and transferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.104633Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:a5345a818508bbb4613838169602380d6c19eca6daa3539fc2107d55aa86f974","observation_id":"83acc41c-f98b-4843-891c-bac937b09a2f","resolution":{"observed_at":"2026-08-09T10:29:50.104633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.419114Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models,","venue":null,"work_id":"a5cc1d7f-7a3b-4d4f-ba49-a6873e3d01fe","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.109343Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:a562ce0ab23a2ae9918812cd0274888e1d9af19c2b1d9a0e9af7efdf1e492568","observation_id":"6c852828-557e-440a-a24d-2c3ad121004b","resolution":{"observed_at":"2026-08-09T10:29:52.423973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.403670Z","title":"Gptfuzzer: Red teaming large language models with auto-generated jailbreak prompts,","venue":null,"work_id":"c6d2ec5b-df67-4ff0-a614-aa0ebdc7511f","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.114143Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:bdf197d42cbe3d229d8e9cadfe2c757be0ffd1997ce74a1b5b8481d72523da71","observation_id":"077b5a60-4f00-4ccc-9698-ff06e00b93fe","resolution":{"observed_at":"2026-08-09T10:29:52.408502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16717","last_updated":"2024-02-26T16:35:59Z","snapshot_observed_at":"2026-08-10T11:33:27.635491Z","submitted_at":"2024-02-26T16:35:59Z","title":"CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16717","snapshot_observed_at":"2026-08-09T10:29:50.118656Z","title":"Codechameleon: Personalized encryp- tion framework for jailbreaking large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.118656Z"},"links":{"cited_paper":"/paper/2402.16717","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:f00f349a4394c22553a5054f8823b4a8f06cefca07afa1fc96278f9ba3dbd358","observation_id":"40d59864-3713-4dba-b09d-52fe250163c7","resolution":{"observed_at":"2026-08-09T10:29:50.118656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.387963Z","title":"Multilingual jailbreak challenges in large language models,","venue":null,"work_id":"68bba877-c71a-4a25-851b-c29d886e94f7","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.123703Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:7b543cdbac323bb8eeee212a51177e13530ebc5d6755c0e7d7527709178c68f7","observation_id":"27f0611d-9193-431a-8cb0-989a89a3d341","resolution":{"observed_at":"2026-08-09T10:29:52.393195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.372192Z","title":"Gpt-4 is too smart to be safe: Stealthy chat with llms via cipher,","venue":null,"work_id":"4f0e69cf-8b89-4c51-978d-eae099541796","year":null},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.128453Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:d93c4fcb52dd7a20f817e2c8457248da40418e0f09bdb8c2599d18264f3c7c4c","observation_id":"5227bde8-5717-452b-9f8e-c3dc72e65ea3","resolution":{"observed_at":"2026-08-09T10:29:52.377291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.356945Z","title":"”do anything now","venue":null,"work_id":"ca58742a-e08b-41e2-baf1-61671c19723b","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.139207Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:8908cfb43baaa704293056dbb821b60c0cbab748ffedf50e8a2da3a0eaf3c794","observation_id":"0515fb4d-df96-4296-b060-edbed182c801","resolution":{"observed_at":"2026-08-09T10:29:52.362042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.340619Z","title":"Ignore previous prompt: Attack techniques for language models,","venue":null,"work_id":"7f2b0cee-f2d1-43b2-b843-c15b64b2bea2","year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.144155Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:23e323770075c65371e6ea119caa28c55db69341ae3a36e9d3f0810b406e4942","observation_id":"b4fffba4-2b19-4bdb-8a92-bd91badb5898","resolution":{"observed_at":"2026-08-09T10:29:52.345773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.070667Z","title":"Why so toxic?: Measuring and triggering toxic behavior in open-domain chatbots,","venue":null,"work_id":"e7ca5fce-d3a3-4dd5-9bd3-92be799e540a","year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.149305Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:69608c9ba72e9bf76f82ea0f0557c2e1f55f968d4563cb6a3d5985fbf11f2063","observation_id":"f0427670-fd64-4894-9a69-e43880894ff9","resolution":{"observed_at":"2026-08-09T10:29:51.075789Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.325301Z","title":"Explore, establish, exploit: Red teaming language models from scratch,","venue":null,"work_id":"7aca2de7-b507-4516-9a50-7a56bc7d5c65","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.154160Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:fecf0acaaed4effa85ad7e83a69d720f23c4dccd0743282659c679fb1e539c9c","observation_id":"2b4f8853-b7c4-49ce-8e56-4e03c9cb7764","resolution":{"observed_at":"2026-08-09T10:29:52.330471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.309387Z","title":"Red teaming language models to reduce harms: Methods, scaling behaviors, and lessons learned,","venue":null,"work_id":"a7d38f12-bea6-49e8-af61-e5dfc3cd8195","year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.159008Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:1211ad585d5249bffe311b75e5d0ce5b11604944397cecdba6561de0766541be","observation_id":"cdcff83d-d586-4c55-8efe-e00b41756c80","resolution":{"observed_at":"2026-08-09T10:29:52.314575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.292196Z","title":"Fuzzllm: A novel and universal fuzzing framework for proactively discovering jailbreak vulnerabilities in large language models,","venue":null,"work_id":"59e762ad-d864-4ece-9d4b-6fc37745ab0f","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.164050Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:8045500e2867832687bd6d48e2bee9db9d274e57ea2589e39f3920419cde1b50","observation_id":"13f5a61b-32ba-4cca-b300-9c58af05f6c7","resolution":{"observed_at":"2026-08-09T10:29:52.297264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.276358Z","title":"Parafuzz: An interpretability-driven technique for de- tecting poisoned samples in NLP,","venue":null,"work_id":"f9e0549e-1c18-4f92-aedc-9d8257bea6c9","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.168813Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:383ddab86943373fa1a75926070eeb438adc54fd1e6a412d36d1410956b4e807","observation_id":"0b0002ce-0557-4128-a8ae-f6ee1b87327d","resolution":{"observed_at":"2026-08-09T10:29:52.281573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.260794Z","title":"Jailbreaking black box large language models in twenty queries,","venue":null,"work_id":"a5cdc927-d6d5-4e2f-861a-69a7489ffd8d","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.173726Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:526becb415cab98c476fbc89fb4221eb5353a357c4692733c2e2eccaaca741ff","observation_id":"35a58323-36bb-4a64-adf3-4a2dbedf27de","resolution":{"observed_at":"2026-08-09T10:29:52.266148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02119","last_updated":"2024-10-31T15:57:42Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:49:23Z","title":"Tree of Attacks: Jailbreaking Black-Box LLMs Automatically","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02119","snapshot_observed_at":"2026-08-09T10:29:50.179302Z","title":"Tree of attacks: Jailbreaking black- box llms automatically,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.179302Z"},"links":{"cited_paper":"/paper/2312.02119","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:e063d9d5f5b780074f75004a702a2ca903c1bcd582d1ed4039109ab36d00b80d","observation_id":"b4306fb1-7467-443d-95f9-1f0994c11411","resolution":{"observed_at":"2026-08-09T10:29:50.179302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.245340Z","title":"Automatically auditing large language models via discrete optimization,","venue":null,"work_id":"929cc314-181f-4258-a198-38d3ebdc53dc","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.184581Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:57b3096b8857de446b7defcd57e9e5294f1b28a77e57071cd0e5743f78eff47d","observation_id":"4bf59265-0dd6-4541-b5de-34e079a08d67","resolution":{"observed_at":"2026-08-09T10:29:52.250283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.228532Z","title":"Eraser: Jailbreaking defense in large language models via unlearning harmful knowledge,","venue":null,"work_id":"a6b81525-a192-41d3-9be5-639f973d8665","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.189925Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:73c1e178a33804c179969091320e9ed08c38b1cf743fe99d7832b0b31523361c","observation_id":"048c2f03-0df1-4d44-a70b-8d025ac9751c","resolution":{"observed_at":"2026-08-09T10:29:52.234306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17263","last_updated":"2024-11-08T06:57:05Z","snapshot_observed_at":"2026-08-06T04:09:50.828544Z","submitted_at":"2024-01-30T18:56:08Z","title":"Robust Prompt Optimization for Defending Language Models Against Jailbreaking Attacks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17263","snapshot_observed_at":"2026-08-09T10:29:50.195132Z","title":"Robust prompt optimization for defending language models against jailbreaking attacks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.195132Z"},"links":{"cited_paper":"/paper/2401.17263","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:d55df6bef28ac3bf5eaaba37901277c3e1b9570208a4c1530b051ca3ccc25d24","observation_id":"be87d481-dcf7-4fbc-b8cd-485ef85dbc5d","resolution":{"observed_at":"2026-08-09T10:29:50.195132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-02T14:59:12.115203Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-09T10:29:50.200326Z","title":"Jailbreakbench: An open robustness benchmark for jailbreaking large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.200326Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:2f22b89893c19e6ce7295cb795579b102fa1ef97ebd168741acc147b6837e1e2","observation_id":"5c5e495d-5ff0-4b45-b5e8-e1887e7cc09e","resolution":{"observed_at":"2026-08-09T10:29:50.200326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-09T10:29:50.205234Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.205234Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:a6aa2227aefc587aa44dbeb44e197ae4b17902f88d5e48cb1f09c895860ac868","observation_id":"7784d2aa-4407-48d7-842c-5ef5d2381eb3","resolution":{"observed_at":"2026-08-09T10:29:50.205234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.209759Z","title":"Break the breakout: Reinventing lm defense against jailbreak attacks with self-refinement,","venue":null,"work_id":"4232449e-d483-4ff8-a495-0acf84617d91","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.210234Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:783d0156533cef29cf819f21ff8d264aef24de3400828d0a648815ab6f30cee0","observation_id":"1d530286-2a76-4e7c-8c91-8634aaf7e179","resolution":{"observed_at":"2026-08-09T10:29:52.215217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.192982Z","title":"Safe rlhf: Safe reinforcement learning from human feedback,","venue":null,"work_id":"4e9a195b-782c-45e4-bab0-8b5d7ae4bc56","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.214784Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:9cfd28b163a0e721b99a8fc9381dd7f1747a964d21e1474aa7a2f8f9586a19e6","observation_id":"0a71edbd-db34-46a8-ac1a-3efcf17f271d","resolution":{"observed_at":"2026-08-09T10:29:52.197830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.178643Z","title":"Smoothllm: Defending large language models against jailbreaking attacks,","venue":null,"work_id":"1c7760d3-ccc0-4a64-91a5-0238598347c1","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.219751Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:4c6794b1bb0c65984db2f60a252f8114cfb70e65a39a45fdc6a3203d03532781","observation_id":"2d8449b8-7072-4e9f-99b6-95d61814dce7","resolution":{"observed_at":"2026-08-09T10:29:52.183392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.163531Z","title":"Defending large language models against jailbreak attacks via semantic smoothing,","venue":null,"work_id":"a3ffaab0-3b14-4c40-917d-8836724add99","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.224633Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:23edb5321ec78d879c9ea13fa21e3ff15950db407d166867e36a75277e18db43","observation_id":"f978740d-617e-446f-9e2b-15e15f6ce5de","resolution":{"observed_at":"2026-08-09T10:29:52.168514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.148426Z","title":"Certified adversarial robustness via randomized smoothing,","venue":null,"work_id":"c49264ae-4f17-47ae-ab80-91f1768b12a9","year":2019},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.229527Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:e616f4bfaa4a90b8a95ab589b75efa3a8e859fdb947754e2cd24e61b41097136","observation_id":"6fdf60ee-d52b-4f45-8aa0-2797d7f35a9f","resolution":{"observed_at":"2026-08-09T10:29:52.153285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.132562Z","title":"Dp-forward: Fine-tuning and inference on language models with differential privacy in forward pass,","venue":null,"work_id":"2f879578-f229-4e02-9fdd-1a1613c8e7b6","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.235191Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:2adb9301407cb4f0f03840d7f0d68da78e9c9d1bfe17496d1d402e61b0094dd5","observation_id":"f4ae7ac6-010a-48fd-a012-e9042fa0a704","resolution":{"observed_at":"2026-08-09T10:29:52.138024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14348","last_updated":"2024-06-12T00:27:06Z","snapshot_observed_at":"2026-07-06T16:23:26.584450Z","submitted_at":"2023-09-18T02:07:22Z","title":"Defending Against Alignment-Breaking Attacks via Robustly Aligned LLM","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14348","snapshot_observed_at":"2026-08-09T10:29:50.240137Z","title":"Defending against alignment-breaking attacks via robustly aligned llm,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.240137Z"},"links":{"cited_paper":"/paper/2309.14348","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:609ed1f774ff687247f983c622d2bcc7dc491024ce0f416ae2d2f66244cf076d","observation_id":"64256897-cf8a-4449-8d82-8bfdd6f80501","resolution":{"observed_at":"2026-08-09T10:29:50.240137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.116397Z","title":"Defending large language models against jailbreaking attacks through goal prioritization,","venue":null,"work_id":"2e387e6e-6c27-4713-9fbe-7c9be6674dc6","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.245375Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:ba78a1a77041a33f491807df0b0fcb9de330fc11f5df922a733d09ef1e6cc4b4","observation_id":"60bbd7e6-be9f-4635-b192-375e4f27b423","resolution":{"observed_at":"2026-08-09T10:29:52.121510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.099980Z","title":"RAIN: Your language models can align themselves without finetuning,","venue":null,"work_id":"85f86409-3c2a-49fa-bba1-90e54094a181","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.250415Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:f56dbd4b6fad5167081f5d3ef5379a3389e6eeefe26ada8447f6cdf57c873e98","observation_id":"5f23e21c-01d7-468d-8e17-a000b7b8c9da","resolution":{"observed_at":"2026-08-09T10:29:52.105189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06767","last_updated":"2023-12-01T14:28:06Z","snapshot_observed_at":"2026-08-07T04:02:54.504761Z","submitted_at":"2023-04-13T18:22:40Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06767","snapshot_observed_at":"2026-08-09T10:29:50.255222Z","title":"RAFT: reward ranked finetuning for generative foundation model alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.255222Z"},"links":{"cited_paper":"/paper/2304.06767","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:652f522f504f216ccde0f45bc0c590f07c5d054dfc06a1a4d1c7171cb5f59d81","observation_id":"4cc1a48c-479a-4f1d-9e7b-0b554279d249","resolution":{"observed_at":"2026-08-09T10:29:50.255222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.082338Z","title":"Direct preference optimization: Your language model is secretly a reward model,","venue":null,"work_id":"42ba2b2d-8498-4962-87fd-7377f323309e","year":2023},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.260548Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:5857f4e44d65bfd1fad7f9d522a64d3a32ac584d66bf139a106b536093f473c3","observation_id":"97eccaa6-3b7e-4e6b-be93-404d0c29c8de","resolution":{"observed_at":"2026-08-09T10:29:52.087339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14321","last_updated":"2024-10-18T09:32:08Z","snapshot_observed_at":"2026-08-06T17:57:10.155611Z","submitted_at":"2024-10-18T09:32:08Z","title":"From Solitary Directives to Interactive Encouragement! LLM Secure Code Generation by Natural Language Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14321","snapshot_observed_at":"2026-08-09T10:29:50.265334Z","title":"From solitary directives to interactive encouragement! llm secure code generation by natural language prompting,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.265334Z"},"links":{"cited_paper":"/paper/2410.14321","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:6cee3e409cf285050b16a3fecb64ed4453e92eef1f4087f3d8850817154058d2","observation_id":"7b237172-e5fa-40f2-b031-b023707127b0","resolution":{"observed_at":"2026-08-09T10:29:50.265334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.064389Z","title":"Design and evaluation of a multi- domain trojan detection method on deep neural networks,","venue":null,"work_id":"b5a9d8f4-cc0c-43cd-a7d5-1ded93d7b21a","year":2021},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.271524Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:a68f01e080a1882925f3e84d327248702af2ff2e988cced22c0240f4abb11acb","observation_id":"be44f680-60a2-493c-ad89-f9d3708c9b3b","resolution":{"observed_at":"2026-08-09T10:29:52.069775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.049044Z","title":"Robust backdoor detection for deep learning via topological evolution dynamics,","venue":null,"work_id":"eef82a83-b686-4569-b0d6-94d38b8db7c6","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.276664Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:68e220c659758fe88391e4436c487bad5a665f6dabe9973c94c46d18f0beea3a","observation_id":"1141e4e6-3988-403d-864d-f742034deac8","resolution":{"observed_at":"2026-08-09T10:29:52.053920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.032649Z","title":"Mm-bd: Post- training detection of backdoor attacks with arbitrary backdoor pattern types using a maximum margin statistic,","venue":null,"work_id":"5ff12a5d-b073-4659-9184-79a90a5b358e","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.281613Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:8a9fea10f0740dbe0a0c286831e890d6d1b7311674c013ff160071db01cd2757","observation_id":"0cbbc101-2f9d-4492-8e00-572d169b4c84","resolution":{"observed_at":"2026-08-09T10:29:52.038290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:52.015764Z","title":"Locating and editing factual associations in gpt,","venue":null,"work_id":"06ad6861-32fd-4d17-a30b-3f2c73801448","year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.287333Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:b4c27fff1cbbb9e186157195560e504111b3f1dd772a038d5af012f7891a9fc0","observation_id":"853ca252-4148-4341-8233-2c489103a4b6","resolution":{"observed_at":"2026-08-09T10:29:52.020986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01286","last_updated":"2024-11-17T06:50:44Z","snapshot_observed_at":"2026-08-09T19:25:28.585645Z","submitted_at":"2024-01-02T16:54:58Z","title":"A Comprehensive Study of Knowledge Editing for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01286","snapshot_observed_at":"2026-08-09T10:29:50.293237Z","title":"A comprehensive study of knowledge editing for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.293237Z"},"links":{"cited_paper":"/paper/2401.01286","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:2ada28f1d82dd1bf17165746af103c324a4b05a8783481c481f915b044b18434","observation_id":"b91e0cd2-87c9-4734-8b1c-d89933be58a3","resolution":{"observed_at":"2026-08-09T10:29:50.293237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:50.738360Z","title":"Federatedscope- llm: A comprehensive package for fine-tuning large language models in federated learning,","venue":null,"work_id":"9482fa3b-bb84-419d-8436-6a1714876296","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.298553Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:5fceed6f043393d9268503b913234f596bccb1ed5d2d855fa2fccc3587a735a4","observation_id":"5d634e7a-1b0e-473a-bcc2-664e7f81050d","resolution":{"observed_at":"2026-08-09T10:29:50.743851Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.999383Z","title":"How to backdoor federated learning,","venue":null,"work_id":"c0d349b0-a220-4cb3-8e3c-ff46781d34ad","year":2020},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.303661Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:9a5d4e68104d40b2afffd3d3aa5d3c71548dacf7166b993ff2c40acfe81f3d6b","observation_id":"796a0fff-ec26-4fc1-8526-7dd636e02b40","resolution":{"observed_at":"2026-08-09T10:29:52.004673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.984151Z","title":"Attack of the tails: Yes, you really can backdoor federated learning,","venue":null,"work_id":"6f38316e-c68c-4529-bf48-cdefb63e42c9","year":2020},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.308505Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:ed62eae37338a19f56bec4fe6ef669792bb71c6f90c9e6073af116b610ec481c","observation_id":"769c9347-0e6a-4b61-96b6-9b0abe01142d","resolution":{"observed_at":"2026-08-09T10:29:51.989077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.969130Z","title":"DBA: distributed backdoor attacks against federated learning,","venue":null,"work_id":"04b74b38-25dd-4c55-ae34-03cf82ed3d7e","year":2020},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.313490Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:921c28844e6fd0ba6f52904f12c5c9252f3b2def259a97cb68dd073dc793e28f","observation_id":"182aaf0f-e1e7-4150-bc29-8eb9bedd3727","resolution":{"observed_at":"2026-08-09T10:29:51.974097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.950806Z","title":"Comprehensive privacy analysis of deep learning: Passive and active white-box inference attacks against centralized and federated learning,","venue":null,"work_id":"c16d52eb-d68b-447d-80ac-7a818a02fad0","year":2019},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.318686Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:db581e5857520c1307e24689cd2947d3a886dfe78f0d4f8bde74afba0b1dc28d","observation_id":"38c9bc5d-b4b3-4c9a-928f-617c61e5c2cc","resolution":{"observed_at":"2026-08-09T10:29:51.955797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:50.572300Z","title":"Practical secure aggregation for privacy-preserving machine learning,","venue":null,"work_id":"78e4bcd5-13a2-4352-8ffb-0f9bf4ba916c","year":2017},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.323785Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:3a3a787781ac7142c71366d0c8ec60fa9fcc679d04044c6a145c1868a9c7a191","observation_id":"6da44e5d-9e0f-41bb-ab92-b4704528b939","resolution":{"observed_at":"2026-08-09T10:29:50.579361Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.935452Z","title":"Machine learning with adversaries: Byzantine tolerant gradient descent,","venue":null,"work_id":"9462263a-b0c4-4e6b-84ea-312b2e7b75b3","year":2017},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.328673Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:b48f058a10d3bdde54990347bbd8dc7ac7953734fbbd9f4ca2eda945a8610cba","observation_id":"b0b1a240-6da9-4ce0-8285-502205b7c9c7","resolution":{"observed_at":"2026-08-09T10:29:51.940389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.919727Z","title":"The hidden vulnerability of distributed learning in byzantium,","venue":null,"work_id":"cae9a669-a30c-4704-afc1-62933773a31a","year":2018},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.333604Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:dfca371ca174c8b3469378424b23b9ba9b03c1da4b736355b08cee8b213ef1d6","observation_id":"d392ee61-5182-4c61-8bc0-ef952115368e","resolution":{"observed_at":"2026-08-09T10:29:51.924697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.902089Z","title":"Fltrust: Byzantine- robust federated learning via trust bootstrapping,","venue":null,"work_id":"7dffa430-f2da-402e-9de4-b3e6815b3301","year":2021},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.338496Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:23c8cd80c34f67cb5fd31f1ff1ba2ca996e21fb702303d6d6945149e2b8c9cf3","observation_id":"942fd518-9702-4825-bb2a-6d3830160b91","resolution":{"observed_at":"2026-08-09T10:29:51.907660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.885134Z","title":"FLAME: taming backdoors in federated learning,","venue":null,"work_id":"eef7aa5c-83e1-4b6a-8be5-b15e698083eb","year":2022},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.343560Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:a4f9c50a81f0a8a56f4e08da8521e1b4a465acad0caccce4f8174517c1a5817a","observation_id":"a161a009-1845-4592-be2b-ecf827a117f0","resolution":{"observed_at":"2026-08-09T10:29:51.890051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.869379Z","title":"Calibrating noise to sensitivity in private data analysis,","venue":null,"work_id":"8bb27f4e-1f4f-4a02-9ec5-6c512ed6cc52","year":2006},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.348498Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:dc5e6d34bfad728458d0b48bd82cd8f6a8537d1d9fb71cebb0336883d48153f4","observation_id":"cfb7fb49-4fa8-4abe-851c-a0d374bfc126","resolution":{"observed_at":"2026-08-09T10:29:51.874529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.834746Z","title":"CRFL: certifiably robust federated learning against backdoor attacks,","venue":null,"work_id":"d70bb51a-c972-4ba0-b8e3-5af92bf7d323","year":2021},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.358410Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:7bc6b803eacbb6c17a15418cb900dac3155a2e82966e0a71018cd088df49d607","observation_id":"1a200729-1063-409b-b03e-d3d55856d2fa","resolution":{"observed_at":"2026-08-09T10:29:51.840239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.809804Z","title":"Yes, one-bit-flip matters! universal dnn model infer- ence depletion with runtime code fault injection,","venue":null,"work_id":"88009c11-fedb-42d3-be1e-803a97e3f952","year":2024},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.362918Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:6eca9661be4488b9e3dfa2f3b84ecc3b3364eab289c139b95dbb4e4917037005","observation_id":"15684c4c-5afb-40d4-9c36-1600e1843c5d","resolution":{"observed_at":"2026-08-09T10:29:51.815803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05197","last_updated":"2023-11-01T05:14:01Z","snapshot_observed_at":"2026-07-06T15:14:24.794122Z","submitted_at":"2023-04-11T13:05:04Z","title":"Multi-step Jailbreaking Privacy Attacks on ChatGPT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05197","snapshot_observed_at":"2026-08-09T10:29:50.045250Z","title":"Available: https://arxiv.org/abs/2304.05197","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.045250Z"},"links":{"cited_paper":"/paper/2304.05197","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:732dcbb4dcd19548e7e8f15b922748b9391759485f93c2585b13385f84d3de7b","observation_id":"9c9bf0fe-1e48-4a6d-87d3-56f181b44334","resolution":{"observed_at":"2026-08-09T10:29:50.045250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06463","last_updated":"2024-03-26T04:23:12Z","snapshot_observed_at":"2026-07-06T16:05:31.757410Z","submitted_at":"2023-08-12T04:05:57Z","title":"GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06463","snapshot_observed_at":"2026-08-09T10:29:50.133416Z","title":"Available: https://arxiv.org/abs/2308.06463","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.133416Z"},"links":{"cited_paper":"/paper/2308.06463","citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:33e8f68713156112b60ef9bf39a622c7ce7d138ae01a56a60ff1799c4b7e9274","observation_id":"ed493799-d566-405d-aa80-3f587e1ba4f4","resolution":{"observed_at":"2026-08-09T10:29:50.133416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:49.999202Z","title":"Available: https://www.usenix.org/conference/ usenixsecurity21/presentation/carlini-extracting","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":2650,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:49.999202Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:715f60223a69e1ae4929c9381ddb8a50eedb8f78b22daf93a1cc909148072731","observation_id":"e7386865-4023-43c7-87bc-dabb6c8be476","resolution":{"observed_at":"2026-08-09T10:29:49.999202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:29:51.852624Z","title":null,"venue":null,"work_id":"8eb74a92-c92c-4cc2-b327-813f0b9bc77a","year":2006},"citing_paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives","version":1},"reference_index":3876,"source":"pdf_text","source_observed_at":"2026-08-09T10:29:50.353576Z"},"links":{"citing_paper":"/paper/2502.02960"},"observation_digest":"sha256:024997e26333cca7bf1ebabafcd6fc68058d238e762c0eda379e86a86c98e116","observation_id":"aba607c0-3780-4ffc-9f3b-86167f74b640","resolution":{"observed_at":"2026-08-09T10:29:51.858717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.02960","last_updated":"2025-02-05T07:54:07Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-09T19:26:08.042239Z","submitted_at":"2025-02-05T07:54:07Z","title":"Large Language Model Adversarial Landscape Through the Lens of Attack Objectives"},"reference_resolution":{"displayed":95,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":5,"verified_fuzzy":46},"total_outbound_references":95},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 95 of 95 outbound references and 2 inbound Pith citation observations for arXiv:2502.02960."}