{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:R4JVREWFH54AEPLOUMQWEEFLJP","short_pith_number":"pith:R4JVREWF","schema_version":"1.0","canonical_sha256":"8f135892c53f78023d6ea3216210ab4bf258032109365b6022c221a0efa438ff","source":{"kind":"arxiv","id":"2502.08586","version":1},"attestation_state":"computed","paper":{"title":"Commercial LLM Agents Are Already Vulnerable to Simple Yet Dangerous Attacks","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.LG","authors_text":"Ang Li, Micah Goldblum, Tom Goldstein, Vethavikashini Chithrra Raghuram, Yin Zhou","submitted_at":"2025-02-12T17:19:36Z","abstract_excerpt":"A high volume of recent ML security literature focuses on attacks against aligned large language models (LLMs). These attacks may extract private information or coerce the model into producing harmful outputs. In real-world deployments, LLMs are often part of a larger agentic pipeline including memory systems, retrieval, web access, and API calling. Such additional components introduce vulnerabilities that make these LLM-powered agents much easier to attack than isolated LLMs, yet relatively little work focuses on the security of LLM agents. In this paper, we analyze security and privacy vulne"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2502.08586","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.LG","submitted_at":"2025-02-12T17:19:36Z","cross_cats_sorted":["cs.AI"],"title_canon_sha256":"1145c2d64a1230efbf92c74579ec258b947031003dabfe196c10d23fb58e0e04","abstract_canon_sha256":"6c92a9cf908baed45828e4d10adab4fec9306c71f172fae18ed14a428b6662a4"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T10:13:24.959949Z","signature_b64":"ew6zc/SckqKomRpX39FtbhC8kLozYOxzJT33negxEfqT0oR7F0+y013sdbUoa1/+JjsP0f3R3Ct1UYKDe+5HBw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"8f135892c53f78023d6ea3216210ab4bf258032109365b6022c221a0efa438ff","last_reissued_at":"2026-07-05T10:13:24.959420Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T10:13:24.959420Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Commercial LLM Agents Are Already Vulnerable to Simple Yet Dangerous Attacks","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.LG","authors_text":"Ang Li, Micah Goldblum, Tom Goldstein, Vethavikashini Chithrra Raghuram, Yin Zhou","submitted_at":"2025-02-12T17:19:36Z","abstract_excerpt":"A high volume of recent ML security literature focuses on attacks against aligned large language models (LLMs). These attacks may extract private information or coerce the model into producing harmful outputs. In real-world deployments, LLMs are often part of a larger agentic pipeline including memory systems, retrieval, web access, and API calling. Such additional components introduce vulnerabilities that make these LLM-powered agents much easier to attack than isolated LLMs, yet relatively little work focuses on the security of LLM agents. In this paper, we analyze security and privacy vulne"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2502.08586","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2502.08586/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2502.08586","created_at":"2026-07-05T10:13:24.959489+00:00"},{"alias_kind":"arxiv_version","alias_value":"2502.08586v1","created_at":"2026-07-05T10:13:24.959489+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2502.08586","created_at":"2026-07-05T10:13:24.959489+00:00"},{"alias_kind":"pith_short_12","alias_value":"R4JVREWFH54A","created_at":"2026-07-05T10:13:24.959489+00:00"},{"alias_kind":"pith_short_16","alias_value":"R4JVREWFH54AEPLO","created_at":"2026-07-05T10:13:24.959489+00:00"},{"alias_kind":"pith_short_8","alias_value":"R4JVREWF","created_at":"2026-07-05T10:13:24.959489+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":8,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.13385","citing_title":"Who Pays the Price? Stakeholder-Centric Prompt Injection Benchmarking for Real-world Web Agents","ref_index":12,"is_internal_anchor":false},{"citing_arxiv_id":"2605.23989","citing_title":"Towards trustworthy agentic AI: a comprehensive survey of safety, robustness, privacy, and system security","ref_index":99,"is_internal_anchor":false},{"citing_arxiv_id":"2605.24069","citing_title":"When the Manual Lies: A Realistic Benchmark to Evaluate MCP Poisoning Attacks for LLM Agents","ref_index":9,"is_internal_anchor":false},{"citing_arxiv_id":"2606.28666","citing_title":"Why Trust Your Agent? Empirical Security Gains from TRiSM-Guided Agentic Workflows in Healthcare","ref_index":21,"is_internal_anchor":false},{"citing_arxiv_id":"2503.21460","citing_title":"Large Language Model Agent: A Survey on Methodology, Applications and Challenges","ref_index":175,"is_internal_anchor":false},{"citing_arxiv_id":"2510.23883","citing_title":"Agentic AI Security: Threats, Defenses, Evaluation, and Open Challenges","ref_index":44,"is_internal_anchor":false},{"citing_arxiv_id":"2601.20375","citing_title":"LLM-AutoDP: Automatic Data Processing via LLM Agents for Model Fine-tuning","ref_index":23,"is_internal_anchor":false},{"citing_arxiv_id":"2604.24348","citing_title":"OS-SPEAR: A Toolkit for the Safety, Performance,Efficiency, and Robustness Analysis of OS Agents","ref_index":34,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/R4JVREWFH54AEPLOUMQWEEFLJP","json":"https://pith.science/pith/R4JVREWFH54AEPLOUMQWEEFLJP.json","graph_json":"https://pith.science/api/pith-number/R4JVREWFH54AEPLOUMQWEEFLJP/graph.json","events_json":"https://pith.science/api/pith-number/R4JVREWFH54AEPLOUMQWEEFLJP/events.json","paper":"https://pith.science/paper/R4JVREWF"},"agent_actions":{"view_html":"https://pith.science/pith/R4JVREWFH54AEPLOUMQWEEFLJP","download_json":"https://pith.science/pith/R4JVREWFH54AEPLOUMQWEEFLJP.json","view_paper":"https://pith.science/paper/R4JVREWF","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2502.08586&json=true","fetch_graph":"https://pith.science/api/pith-number/R4JVREWFH54AEPLOUMQWEEFLJP/graph.json","fetch_events":"https://pith.science/api/pith-number/R4JVREWFH54AEPLOUMQWEEFLJP/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/R4JVREWFH54AEPLOUMQWEEFLJP/action/timestamp_anchor","attest_storage":"https://pith.science/pith/R4JVREWFH54AEPLOUMQWEEFLJP/action/storage_attestation","attest_author":"https://pith.science/pith/R4JVREWFH54AEPLOUMQWEEFLJP/action/author_attestation","sign_citation":"https://pith.science/pith/R4JVREWFH54AEPLOUMQWEEFLJP/action/citation_signature","submit_replication":"https://pith.science/pith/R4JVREWFH54AEPLOUMQWEEFLJP/action/replication_record"}},"created_at":"2026-07-05T10:13:24.959489+00:00","updated_at":"2026-07-05T10:13:24.959489+00:00"}