{"as_of":"2026-08-21T22:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1d1b95f93b65ee1e9adfe3f95dffd6991f91fc1a91e8dd3a6460bb9e300bb450","coverage":[{"denominator":97,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":97,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T01:33:25.006611Z","state":"measured"},{"denominator":97,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":97,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25379/citation-record","integrity":"/paper/2607.25379/integrity","json":"/paper/2607.25379/citation-record.json","paper":"/paper/2607.25379"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:15.784247Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:15.784247Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:37f3f1bd0f11abf3188d5ca97eb04034ceba3bc07b6bf6a2d111486863599dc6","observation_id":"4b1ecfb1-a32b-427d-ae04-cc9f047617da","resolution":{"observed_at":"2026-08-04T01:33:15.784247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-13T16:55:46.498156Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-04T01:33:15.828479Z","title":"Voyager: An open-ended embodied agent with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:15.828479Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:ba05b2be263e28bfed2fe100fa44d4b52402d873f394fa97716462253e29d056","observation_id":"58f393db-9a36-4052-aa3c-152ea5562d0a","resolution":{"observed_at":"2026-08-04T01:33:15.828479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08560","last_updated":"2024-02-12T18:59:46Z","snapshot_observed_at":"2026-08-21T06:21:03.420337Z","submitted_at":"2023-10-12T17:51:32Z","title":"MemGPT: Towards LLMs as Operating Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08560","snapshot_observed_at":"2026-08-04T01:33:15.974430Z","title":"Patil, Ion Stoica, and Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:15.974430Z"},"links":{"cited_paper":"/paper/2310.08560","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:0e374bab4cc123fa4d4b535bbaea151b51b46e05b5cdbcdf5eb30772f485d0d4","observation_id":"6cd74131-6803-42da-bbf4-85a8751e8690","resolution":{"observed_at":"2026-08-04T01:33:15.974430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:16.055615Z","title":"Security incident disclosure — july 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:16.055615Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:7dac75c096b768905625e20efddfcacb4855f8708bf902c6aa5a538eccd5c988","observation_id":"8818ff40-b6d6-474e-b824-037a810618cc","resolution":{"observed_at":"2026-08-04T01:33:16.055615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:16.146975Z","title":"Openai and hugging face partner to address security incident during model evalua- tion","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:16.146975Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:02eeabb4147c03200f6796e1ed93440780979bfaa428c6b634c216ef7b85fb52","observation_id":"e034f0cd-50c4-4291-8e3d-8f07bf78cab1","resolution":{"observed_at":"2026-08-04T01:33:16.146975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:16.205434Z","title":"Investigating three real-world incidents in our cybersecurity evaluations.https:// www.anthropic.com/news/investigating-incidents-cybersecurity-evals, July 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:16.205434Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:ca49273991872ddb857c88862a7ade52248aee4ef7de2f5f7b06bf99ecd07b90","observation_id":"d4cf60a2-5275-4f63-a535-fe36c38030cd","resolution":{"observed_at":"2026-08-04T01:33:16.205434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:16.329925Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:16.329925Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:27e30363ee77020c96f187d68001c12ae92177612c24fb3496288faac47078d9","observation_id":"af26caf1-267e-4b61-80fd-77ee21c3ec40","resolution":{"observed_at":"2026-08-04T01:33:16.329925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:16.381013Z","title":"Ai agents under threat: A survey of key security challenges and future pathways.ACM Computing Surveys, 57(7):1–36, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:16.381013Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:6302c5ef1c65d13c47fbb32e64d81dd13ef86f64cb2b65df6f30e412963c4a47","observation_id":"230547cb-85cf-4214-b42a-01a3bbc6251d","resolution":{"observed_at":"2026-08-04T01:33:16.381013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:16.462334Z","title":"Trustworthy AI: From principles to practices.ACM Computing Surveys, 55(9):177, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:16.462334Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:6546f16397f9317ffaade75f1272b887ead4e36cb44cc6339601fa575b37a314","observation_id":"23ee8a47-b174-4f68-8a36-446b8781fdf9","resolution":{"observed_at":"2026-08-04T01:33:16.462334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.23883","last_updated":"2026-04-03T16:27:34Z","snapshot_observed_at":"2026-08-13T20:52:15.127327Z","submitted_at":"2025-10-27T21:48:11Z","title":"Agentic AI Security: Threats, Defenses, Evaluation, and Open Challenges","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.23883","snapshot_observed_at":"2026-08-04T01:33:16.528497Z","title":"Agentic ai security: Threats, defenses, evaluation, and open challenges","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:16.528497Z"},"links":{"cited_paper":"/paper/2510.23883","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:ce0a529e30fc8ab8151bb1e34446bab77c91870a04f996ee688e2347a1994204","observation_id":"1901fd3e-b204-464b-a7b5-93bebeaa5abf","resolution":{"observed_at":"2026-08-04T01:33:16.528497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.28450","last_updated":"2026-06-26T09:32:11Z","snapshot_observed_at":"2026-08-15T00:10:07.741124Z","submitted_at":"2026-06-26T09:32:11Z","title":"LLM agents security duality: a comprehensive survey of self-security and empowered cybersecurity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.28450","snapshot_observed_at":"2026-08-04T01:33:16.609232Z","title":"Llm agents security duality: a comprehensive survey of self-security and empowered cybersecurity","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:16.609232Z"},"links":{"cited_paper":"/paper/2606.28450","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:e16498968c9e7cbae96fea7192a8a1952fb892d43d28266e1c8a95900e84c986","observation_id":"d43477af-b51d-4237-90b5-0ba5b15645b0","resolution":{"observed_at":"2026-08-04T01:33:16.609232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:16.652342Z","title":"Not what you’ve signed up for: Compromising real-world llm-integrated applications with indirect prompt injection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:16.652342Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:c06f9635d98d39ba5016c12219d518fb693deeced4ac3a87bfe7e614c7688656","observation_id":"ac27046b-f2a0-4e2f-959b-56433b82e6dc","resolution":{"observed_at":"2026-08-04T01:33:16.652342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05499","last_updated":"2025-12-29T02:25:27Z","snapshot_observed_at":"2026-07-06T15:40:27.639368Z","submitted_at":"2023-06-08T18:43:11Z","title":"Prompt Injection attack against LLM-integrated Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05499","snapshot_observed_at":"2026-08-04T01:33:16.735859Z","title":"Prompt injection attack against llm-integrated applications","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:16.735859Z"},"links":{"cited_paper":"/paper/2306.05499","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:895e75a11243babe001029f31bdf69fa1714ff428c9c303765b0d81970fc3ea8","observation_id":"d75c3d8c-95af-4c8f-9b15-c9bf185f3dd9","resolution":{"observed_at":"2026-08-04T01:33:16.735859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:16.817208Z","title":"AgentDojo: A dynamic environment to evaluate prompt injection attacks and defenses for LLM agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:16.817208Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:deb2c73442e8c54834833c66ffd960b5db33f9bbd9c7222f8f06bab0650b5a46","observation_id":"b54359a6-bcb2-4682-83a8-d6b0060e1224","resolution":{"observed_at":"2026-08-04T01:33:16.817208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.11086","last_updated":"2026-05-11T18:00:14Z","snapshot_observed_at":"2026-08-16T23:33:20.820875Z","submitted_at":"2026-05-11T18:00:14Z","title":"ExploitGym: Can AI Agents Turn Security Vulnerabilities into Real Attacks?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.11086","snapshot_observed_at":"2026-08-04T01:33:16.909157Z","title":"ExploitGym: Can AI agents turn security vulnerabilities into real attacks? arXiv preprint, arXiv:2605.11086, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:16.909157Z"},"links":{"cited_paper":"/paper/2605.11086","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:1427e9616ce8db4f8efd88b6b218d75547ed75d9eabb4776eb6a318b824f1f6d","observation_id":"b0fd2b72-dac0-408c-828b-bb9c482dde02","resolution":{"observed_at":"2026-08-04T01:33:16.909157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:16.980985Z","title":"Brown, and Francis Rhys Ward","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:16.980985Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:3304ae1dbc8139c09b0c6efb67c56c9e995005b87c56a5e7f797c779de60205d","observation_id":"114118d8-2600-4dc3-b0c5-659119391a12","resolution":{"observed_at":"2026-08-04T01:33:16.980985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14093","last_updated":"2024-12-20T02:22:19Z","snapshot_observed_at":"2026-08-13T11:12:58.507759Z","submitted_at":"2024-12-18T17:41:24Z","title":"Alignment faking in large language models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14093","snapshot_observed_at":"2026-08-04T01:33:17.051827Z","title":"Bowman, and Evan Hubinger","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:17.051827Z"},"links":{"cited_paper":"/paper/2412.14093","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:a40577f3ac9610229420249126d6bc49c4c72d588260f6cf4b6f24c36ae71660","observation_id":"4d52c813-f9d1-4713-9cb1-182b7b01de33","resolution":{"observed_at":"2026-08-04T01:33:17.051827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:17.087617Z","title":"Wong, Xiaowei Huang, Qiufeng Wang, and Kaizhu Huang","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:17.087617Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:7d99fdc2e9df047f5559a4127ec0cdce36a1af9b2a5af0dd86e0072c6f21e771","observation_id":"d98c3892-abe4-49a7-bdf8-49a72e76b440","resolution":{"observed_at":"2026-08-04T01:33:17.087617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:17.142426Z","title":"Models are codes: Towards measuring malicious code poisoningattacksonpre-trainedmodelhubs","venue":null,"work_id":null,"year":2087},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:17.142426Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:ba9d24444dcf9b3c9b8b34aed7e5b89a97396fadf2e42f9e4058efe42f58d5a6","observation_id":"44a0fde9-d8e2-4d81-84dc-0884e3032c85","resolution":{"observed_at":"2026-08-04T01:33:17.142426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:17.252637Z","title":"BackdoorLLM: A compre- hensive benchmark for backdoor attacks and defenses on large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:17.252637Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:b117480e823fda5be2bcce2edbaa6c440570a9b282afe136f0d63ff5a9502daa","observation_id":"c3146927-b6d0-40a2-8429-c4853861a66d","resolution":{"observed_at":"2026-08-04T01:33:17.252637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.02277","last_updated":"2026-08-01T15:05:15Z","snapshot_observed_at":"2026-08-20T07:41:25.347746Z","submitted_at":"2026-03-01T22:47:39Z","title":"Quantifying Frontier LLM Capabilities for Container Sandbox Escape","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.02277","snapshot_observed_at":"2026-08-04T01:33:17.342231Z","title":"Quantifying frontier llm capabilities for container sandbox escape","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:17.342231Z"},"links":{"cited_paper":"/paper/2603.02277","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:25c112726035bef8d19e59600e6741bdf51d9f2dcb1b1b76dcd30046e36e9a4b","observation_id":"4fec7acb-fbcf-4932-ba50-3a1a319537be","resolution":{"observed_at":"2026-08-04T01:33:17.342231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:17.385588Z","title":"Caging the agents: A zero trust security architecture for autonomous ai in healthcare","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:17.385588Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:1f68209fe14e0bab0ebb178a9ce7d465ba3776bc4d7e3063db33a0ff01d80ef9","observation_id":"5eecdb61-f7a3-4b50-bd63-a7dd32c325c5","resolution":{"observed_at":"2026-08-04T01:33:17.385588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20496","last_updated":"2026-04-22T12:28:23Z","snapshot_observed_at":"2026-08-14T12:29:54.133753Z","submitted_at":"2026-04-22T12:28:23Z","title":"Mythos and the Unverified Cage: Z3-Based Pre-Deployment Verification for Frontier-Model Sandbox Infrastructure","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.20496","snapshot_observed_at":"2026-08-04T01:33:17.449910Z","title":"Mythos and the unverified cage: Z3-based pre-deployment verification for frontier-model sandbox infrastructure","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:17.449910Z"},"links":{"cited_paper":"/paper/2604.20496","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:11b530b4a327c2a95a55046ff5c06d852c0c5cf4579d161a742dcdd05b81a8d4","observation_id":"ce22be19-6213-4d5a-b898-2220a755b6da","resolution":{"observed_at":"2026-08-04T01:33:17.449910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09114","last_updated":"2024-11-02T09:35:35Z","snapshot_observed_at":"2026-08-16T13:10:44.478498Z","submitted_at":"2024-10-10T12:06:48Z","title":"Catastrophic Cyber Capabilities Benchmark (3CB): Robustly Evaluating LLM Agent Cyber Offense Capabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09114","snapshot_observed_at":"2026-08-04T01:33:17.528517Z","title":"Catastrophic cyber capabilities benchmark (3CB): Robustly evaluating LLM agent cyber offense capabilities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:17.528517Z"},"links":{"cited_paper":"/paper/2410.09114","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:e21fc5cc3a66d00d5c1c2c279dc937b8370c3c8c1ac2cdc50f0d6253ba491d9b","observation_id":"9bd63fa3-065b-47da-b812-7f0fe6789cf9","resolution":{"observed_at":"2026-08-04T01:33:17.528517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04724","last_updated":"2023-12-07T22:07:54Z","snapshot_observed_at":"2026-08-19T12:42:32.480799Z","submitted_at":"2023-12-07T22:07:54Z","title":"Purple Llama CyberSecEval: A Secure Coding Benchmark for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04724","snapshot_observed_at":"2026-08-04T01:33:17.643282Z","title":"Purple llama cyberseceval: A secure coding benchmark for language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:17.643282Z"},"links":{"cited_paper":"/paper/2312.04724","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:62b951c6c68a6735fe9f133cb32255c6f4b253d12ed5b77c6cb7d97ad9cfd86b","observation_id":"c2eb78e9-4e54-4e10-a6a0-07da0442523b","resolution":{"observed_at":"2026-08-04T01:33:17.643282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13161","last_updated":"2024-04-19T20:11:12Z","snapshot_observed_at":"2026-08-19T22:01:43.251521Z","submitted_at":"2024-04-19T20:11:12Z","title":"CyberSecEval 2: A Wide-Ranging Cybersecurity Evaluation Suite for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13161","snapshot_observed_at":"2026-08-04T01:33:17.718253Z","title":"Cyberseceval 2: A wide-ranging cybersecurity evaluation suite for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:17.718253Z"},"links":{"cited_paper":"/paper/2404.13161","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:2c3af205cab39c3b2f5556cdd4fe9b1b5d4c1a544212318e65937e5e91599c59","observation_id":"01562421-eeb2-4448-82a6-b74dc133ad02","resolution":{"observed_at":"2026-08-04T01:33:17.718253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01605","last_updated":"2024-09-06T18:17:07Z","snapshot_observed_at":"2026-08-19T21:56:58.303635Z","submitted_at":"2024-08-02T23:47:27Z","title":"CYBERSECEVAL 3: Advancing the Evaluation of Cybersecurity Risks and Capabilities in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01605","snapshot_observed_at":"2026-08-04T01:33:17.721562Z","title":"CYBERSECEVAL 3: Advancing the evaluation of cybersecurity risks and capabilities in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:17.721562Z"},"links":{"cited_paper":"/paper/2408.01605","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:14f46884f5817a7ab86ca35dfd347b05aa5824d8b2b49bde2dc47ecf9e4f7ab5","observation_id":"dc06e131-b236-4097-b755-8ec57ad496b1","resolution":{"observed_at":"2026-08-04T01:33:17.721562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:17.758243Z","title":"Zhang, Neil Perry, Riya Dulepet, Joey Ji, Celeste Menders, Justin W","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:17.758243Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:fa38c3f125114fe8a0fad03ceac762917146eff406c58cbb19be1387cbb54e73","observation_id":"73831b72-d0ad-4e04-b24b-93457d9a1df9","resolution":{"observed_at":"2026-08-04T01:33:17.758243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:17.874815Z","title":"Nyu ctf bench: A scalable open-source benchmark dataset for evaluating llms in offensive security","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:17.874815Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:08325a91d27b067dd0324e507b0777ec8cac78a02abc0f807928006ed402632c","observation_id":"4799d76c-434d-492c-bd3c-fce70425c30f","resolution":{"observed_at":"2026-08-04T01:33:17.874815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:18.014852Z","title":"Training language model agents to find vulnerabilities with ctf-dojo","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:18.014852Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:124808ccd27b8008f3e9f7f40c5625bf62c935a76a0155227dc27fff527218e9","observation_id":"62901f7c-247d-46e2-8694-57def320e741","resolution":{"observed_at":"2026-08-04T01:33:18.014852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.11504","last_updated":"2026-07-11T11:49:33Z","snapshot_observed_at":"2026-08-15T01:02:00.830429Z","submitted_at":"2026-05-12T04:23:42Z","title":"CTFusion: A CTF-based Benchmark for LLM Agent Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.11504","snapshot_observed_at":"2026-08-04T01:33:18.181697Z","title":"Ctfusion: A ctf-based benchmark for llm agent evaluation","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:18.181697Z"},"links":{"cited_paper":"/paper/2605.11504","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:08a415b2e5f46a43f02c6f4d244145d2c0fb09806fc4aff9a85b702bc41f9b30","observation_id":"2b6b1d46-5ba9-4358-a259-7fc5fef82a7f","resolution":{"observed_at":"2026-08-04T01:33:18.181697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.05523","last_updated":"2026-04-17T13:49:22Z","snapshot_observed_at":"2026-08-17T11:43:24.123739Z","submitted_at":"2026-02-05T10:30:57Z","title":"Capture the Flags: Family-Based Evaluation of Agentic LLMs via Semantics-Preserving Transformations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.05523","snapshot_observed_at":"2026-08-04T01:33:18.347880Z","title":"Donaldson","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:18.347880Z"},"links":{"cited_paper":"/paper/2602.05523","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:181e0ffebd7c691dd7174b6b8173596c7dff1358c706461ceb6b2b33d05121aa","observation_id":"17101f3f-2be3-406d-9b65-ff911fda21f2","resolution":{"observed_at":"2026-08-04T01:33:18.347880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.08023","last_updated":"2026-05-20T17:32:45Z","snapshot_observed_at":"2026-08-16T11:05:34.500082Z","submitted_at":"2026-02-08T15:56:22Z","title":"CTFExplorer: Evaluating LLM Offensive Agents Through Multi-Target Web CTF Benchmarking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.08023","snapshot_observed_at":"2026-08-04T01:33:18.451383Z","title":"Shukla, Prashanth Krishnamurthy, Farshad Khorrami, Muhammad Shafique, and Ramesh Karri","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:18.451383Z"},"links":{"cited_paper":"/paper/2602.08023","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:93cf3c079d76c285b13c7c1cfaa6f8d394faa4d5cd27c8f632080a561f255229","observation_id":"395d9ebe-03ab-445c-8287-9b655f0b49b4","resolution":{"observed_at":"2026-08-04T01:33:18.451383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05674","last_updated":"2026-04-09T15:07:37Z","snapshot_observed_at":"2026-08-05T12:09:57.803393Z","submitted_at":"2025-08-05T03:25:09Z","title":"Towards Effective Offensive Security LLM Agents: Hyperparameter Tuning, LLM as a Judge, and a Lightweight CTF Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.05674","snapshot_observed_at":"2026-08-04T01:33:18.557054Z","title":"Towards effective offensive security llm agents: Hyperparameter tuning, llm as a judge, and a lightweight ctf benchmark","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:18.557054Z"},"links":{"cited_paper":"/paper/2508.05674","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:3f40788bc2d891d3c4a40ffd3bffa854cfda1fd29c1593494f6f09db6bdbd77f","observation_id":"c9a45d0d-0a72-454a-b431-6dd3e2cb519e","resolution":{"observed_at":"2026-08-04T01:33:18.557054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:18.598260Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:18.598260Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:19ff73f83f3aa151a0648913ad9ff6dc48628a8edf82492316df77c13dae50c2","observation_id":"5ff05668-26f6-4cfe-9f2e-a6881cf313b2","resolution":{"observed_at":"2026-08-04T01:33:18.598260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20787","last_updated":"2025-01-06T07:22:50Z","snapshot_observed_at":"2026-08-20T06:03:11.672456Z","submitted_at":"2024-12-30T08:11:54Z","title":"SecBench: A Comprehensive Multi-Dimensional Benchmarking Dataset for LLMs in Cybersecurity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20787","snapshot_observed_at":"2026-08-04T01:33:18.644653Z","title":"Secbench: A comprehensive multi-dimensional benchmarking dataset for llms in cybersecurity","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:18.644653Z"},"links":{"cited_paper":"/paper/2412.20787","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:77d74acba077d4aeb2e80c4b617c7da29d27416445a4e0af0b7fd68ad785e91a","observation_id":"47bd9e88-f30f-44b0-a93c-9a69dddeb1eb","resolution":{"observed_at":"2026-08-04T01:33:18.644653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:18.806915Z","title":"Sec-bench: Automated bench- marking of llm agents on real-world software security tasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:18.806915Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:5441301d303c3ae5bc3898467587aab52472c297b18dcc27eb8c50e37e0b0bc5","observation_id":"4fe808f1-b9a6-4eb2-a095-14c19ba9efff","resolution":{"observed_at":"2026-08-04T01:33:18.806915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:18.907167Z","title":"Do agents dream of root shells? partial-credit evaluation of llm agents in capture the flag challenges","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:18.907167Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:f7e94580e4569288c564d8a8c42c522c3ef22bef86673058b6a7a53a706079a8","observation_id":"88bc2482-ae0e-4adf-b530-e8df86e4e0d5","resolution":{"observed_at":"2026-08-04T01:33:18.907167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:19.018364Z","title":"AISI frontier AI trends report (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:19.018364Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:85c3296f0c7291bf28a180a6eb4d64b256cf486c91775b61248b212436160aa7","observation_id":"fb64236f-b72d-4290-aa0f-e05f363f27c4","resolution":{"observed_at":"2026-08-04T01:33:19.018364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14499","last_updated":"2026-07-10T21:48:09Z","snapshot_observed_at":"2026-08-16T12:48:53.169158Z","submitted_at":"2025-03-18T17:59:31Z","title":"Measuring AI Ability to Complete Long Software Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14499","snapshot_observed_at":"2026-08-04T01:33:19.105611Z","title":"Ziegler, Elizabeth Barnes, and Lawrence Chan","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:19.105611Z"},"links":{"cited_paper":"/paper/2503.14499","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:1045bdb57d997d41f15a563a4810c091d3fff59112de8164281ab1c75ff39fc4","observation_id":"b371816d-fa8c-43b7-ada5-2737a85cb7f4","resolution":{"observed_at":"2026-08-04T01:33:19.105611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:19.196868Z","title":"Secret cyberspace: The growing risk of AI-enabled cyber operations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:19.196868Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:04adffda7e35c9e08631dcfb2e72f70be317119de7c5590eddd63c736ceed9d6","observation_id":"d31b2288-5544-4e31-9177-925ab32baa41","resolution":{"observed_at":"2026-08-04T01:33:19.196868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:19.265245Z","title":"Operationalizing AI-enabled cyberoperations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:19.265245Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:e7f018c2bbaceee12c0cde41154941adf64d2af3e58645109f5620c91f46215e","observation_id":"b9235b64-41ab-49e1-9e7c-ee86dc7ff743","resolution":{"observed_at":"2026-08-04T01:33:19.265245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.21956","last_updated":"2026-05-21T03:44:02Z","snapshot_observed_at":"2026-08-18T17:49:42.035202Z","submitted_at":"2026-05-21T03:44:02Z","title":"Detecting Offensive Cyber Agents: A Detection-in-Depth Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.21956","snapshot_observed_at":"2026-08-04T01:33:19.317887Z","title":"Detecting offensive cyber agents: A detection-in-depth approach","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:19.317887Z"},"links":{"cited_paper":"/paper/2605.21956","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:dadb90d20ad74b3408d32410bfe3ad9915218badf20f831fec70cc26fcc8351d","observation_id":"a151a0e6-9652-4d21-86fe-a5def62927a4","resolution":{"observed_at":"2026-08-04T01:33:19.317887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:19.431953Z","title":"Injecagent: Benchmarking indirect prompt injections in tool-integrated large language model agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:19.431953Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:059cfacf8568867bce482c7d3d286d242b590eb1b9d9ade08a68b25dfa92782c","observation_id":"fdeaf38d-8141-458e-9e94-217591ab3591","resolution":{"observed_at":"2026-08-04T01:33:19.431953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:19.544846Z","title":"Memory poisoning attack and defense on memory based llm-agents","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:19.544846Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:d9ac6a680e73d8eccaa576c7337811b906eba7fb7a1fc85513cd5c3d9b3a43c5","observation_id":"7cc4fbbd-3dbc-41de-8199-ba3b4156b4fd","resolution":{"observed_at":"2026-08-04T01:33:19.544846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:19.655825Z","title":"The benchmark that broke con- tainment: An openai evaluation model escaped its sandbox and breached hugging face","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:19.655825Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:4855e39b42a9cd7e86073a6fe2a12e587d7087ca8a07384e9547f057ebe40dcc","observation_id":"5906f86f-841a-4efc-a1c3-e66961609351","resolution":{"observed_at":"2026-08-04T01:33:19.655825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05566","last_updated":"2024-01-17T20:26:01Z","snapshot_observed_at":"2026-08-15T14:10:05.296241Z","submitted_at":"2024-01-10T22:14:35Z","title":"Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05566","snapshot_observed_at":"2026-08-04T01:33:19.731256Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:19.731256Z"},"links":{"cited_paper":"/paper/2401.05566","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:41a3a7ae2ddefffd521dc0dd991f05a5d8319fefb6d34dbeb70013890f714915","observation_id":"20395e23-5f83-4b38-bf09-bab92d33b930","resolution":{"observed_at":"2026-08-04T01:33:19.731256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:19.832136Z","title":"Optimal policies tend to seek power","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:19.832136Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:df2404bfce9b694068ac443cfd8ee4ac5cca1c7e081630a0424a4bcfeac5e62e","observation_id":"e9f79381-7679-41b0-9f32-0a6ebc862bab","resolution":{"observed_at":"2026-08-04T01:33:19.832136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.03081","last_updated":"2026-04-03T14:58:58Z","snapshot_observed_at":"2026-08-15T02:21:36.634688Z","submitted_at":"2026-04-03T14:58:58Z","title":"Supply-Chain Poisoning Attacks Against LLM Coding Agent Skill Ecosystems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.03081","snapshot_observed_at":"2026-08-04T01:33:19.924770Z","title":"Supply-chain poisoning attacks against LLM coding agent skill ecosystems","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:19.924770Z"},"links":{"cited_paper":"/paper/2604.03081","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:20f1424db63f74a533ff6527972c8d3c0251a0d808437fd9aee54e82c8e6d38c","observation_id":"b0062fbb-1487-4717-a5ff-58995bfeb0af","resolution":{"observed_at":"2026-08-04T01:33:19.924770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:20.024421Z","title":"Model supply chain poisoning: Backdooring pre-trained models via embedding indistinguishability","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:20.024421Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:3553f143f20fc4a1a04e89bddf21b4e81967cdcef799b1c0f165d9adc0237db5","observation_id":"cc1cd9ce-e7d2-4cfa-8a44-855560a8705e","resolution":{"observed_at":"2026-08-04T01:33:20.024421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.24949","last_updated":"2026-05-24T08:54:33Z","snapshot_observed_at":"2026-08-13T19:52:31.045207Z","submitted_at":"2026-05-24T08:54:33Z","title":"APT-Agent: Automated Penetration Testing using Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.24949","snapshot_observed_at":"2026-08-04T01:33:20.120897Z","title":"Apt-agent: Automated penetration testing using large language models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:20.120897Z"},"links":{"cited_paper":"/paper/2605.24949","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:d685d18a6e645a70e6649750347f91a8f7ddce3696165b94910cfdb63c80e568","observation_id":"0e9d7999-2ff2-4d56-b33a-20bf534e2e56","resolution":{"observed_at":"2026-08-04T01:33:20.120897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.18239","last_updated":"2026-04-10T03:16:51Z","snapshot_observed_at":"2026-08-17T22:02:12.594246Z","submitted_at":"2026-04-10T03:16:51Z","title":"SysAdmin: Measuring Instrumental Power-Seeking in Frontier AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.18239","snapshot_observed_at":"2026-08-04T01:33:20.189768Z","title":"Sysadmin: Measuring instrumental power-seeking in frontier ai","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:20.189768Z"},"links":{"cited_paper":"/paper/2607.18239","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:a0b53fc3799d07652eb986d08cf17ac2c672a2615680661113a4ed41fb58ef72","observation_id":"f14c5bb1-18f3-44d9-b604-89e331dbe67c","resolution":{"observed_at":"2026-08-04T01:33:20.189768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07561","last_updated":"2024-05-09T18:15:12Z","snapshot_observed_at":"2026-08-21T00:29:59.097556Z","submitted_at":"2024-05-09T18:15:12Z","title":"Artificial Intelligence as the New Hacker: Developing Agents for Offensive Security","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07561","snapshot_observed_at":"2026-08-04T01:33:20.244999Z","title":"Artificial intelligence as the new hacker: Developing agents for offensive security","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:20.244999Z"},"links":{"cited_paper":"/paper/2406.07561","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:0428bf123daff21c2db318f2be37bb392881a26b3e6564a72b8032f9c5eba75d","observation_id":"028d3309-188f-49b8-9a21-00d2bf81e06a","resolution":{"observed_at":"2026-08-04T01:33:20.244999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:20.330726Z","title":"Compute trends across three eras of machine learning.https://epoch.ai/publications/ compute-trends, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:20.330726Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:e306c7ad71f6268117504b73f135b69f59525a0c0d6711d81098355763fe911c","observation_id":"dfa9de5f-86aa-4c97-bf44-2ddeaf0d0cbb","resolution":{"observed_at":"2026-08-04T01:33:20.330726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.06595","last_updated":"2026-07-06T19:30:53Z","snapshot_observed_at":"2026-08-18T16:39:33.667263Z","submitted_at":"2026-07-06T19:30:53Z","title":"When Agents Remember Too Much: Memory Poisoning Attacks on Large Language Model Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.06595","snapshot_observed_at":"2026-08-04T01:33:20.388698Z","title":"When agents remember too much: Memory poisoning attacks on large language model agents","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:20.388698Z"},"links":{"cited_paper":"/paper/2607.06595","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:83e050003f9ae1d6eddd641c753e8cdbe6c5c3be4527af0537b9956ab2571e2c","observation_id":"4b2b64cf-abef-4114-9ad0-1c5b1834b20d","resolution":{"observed_at":"2026-08-04T01:33:20.388698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06664","last_updated":"2024-02-16T04:02:51Z","snapshot_observed_at":"2026-08-16T14:20:59.361566Z","submitted_at":"2024-02-06T14:46:08Z","title":"LLM Agents can Autonomously Hack Websites","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06664","snapshot_observed_at":"2026-08-04T01:33:20.480890Z","title":"Llm agents can autonomously hack websites","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:20.480890Z"},"links":{"cited_paper":"/paper/2402.06664","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:e63e922c06e08ee7e81488987ffd7af8e0c76e25cd0dc9af0664b97cc31679ec","observation_id":"8de1c133-ebbc-411f-a9b8-957d524402c2","resolution":{"observed_at":"2026-08-04T01:33:20.480890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08144","last_updated":"2024-04-17T04:34:39Z","snapshot_observed_at":"2026-08-15T19:39:28.669101Z","submitted_at":"2024-04-11T22:07:19Z","title":"LLM Agents can Autonomously Exploit One-day Vulnerabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08144","snapshot_observed_at":"2026-08-04T01:33:20.589147Z","title":"Llm agents can autonomously exploit one-day vulnerabilities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:20.589147Z"},"links":{"cited_paper":"/paper/2404.08144","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:e5c71708b4448ce994daeaa389f5b77c2154b349b8816515bdfac01dbcfb0586","observation_id":"99a44064-1425-488e-baf1-e21b294dc361","resolution":{"observed_at":"2026-08-04T01:33:20.589147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01637","last_updated":"2025-03-30T00:26:48Z","snapshot_observed_at":"2026-08-19T21:09:58.417360Z","submitted_at":"2024-06-02T16:25:26Z","title":"Teams of LLM Agents can Exploit Zero-Day Vulnerabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01637","snapshot_observed_at":"2026-08-04T01:33:20.664144Z","title":"Teams of llm agents can exploit zero-day vulnerabilities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:20.664144Z"},"links":{"cited_paper":"/paper/2406.01637","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:2f2e18f6b325b173ce908cd7d76c3348e6a96b058a2c1729af5c8bec0ba69f80","observation_id":"e9239750-4b21-457c-83d3-775a95b46d45","resolution":{"observed_at":"2026-08-04T01:33:20.664144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06782","last_updated":"2024-06-02T16:16:49Z","snapshot_observed_at":"2026-08-20T00:31:25.578747Z","submitted_at":"2023-08-13T14:35:50Z","title":"PentestGPT: An LLM-empowered Automatic Penetration Testing Tool","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06782","snapshot_observed_at":"2026-08-04T01:33:20.742477Z","title":"Pentestgpt: An llm-empowered automatic penetra- tion testing tool","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:20.742477Z"},"links":{"cited_paper":"/paper/2308.06782","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:37cd0c00aac772236fd2f6ee1b795dea2272aad44ce4549b4cec93dff5ea16a0","observation_id":"66e38e52-c376-4f47-95c6-0e4895419de3","resolution":{"observed_at":"2026-08-04T01:33:20.742477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01778","last_updated":"2024-12-02T18:28:18Z","snapshot_observed_at":"2026-08-14T18:01:24.453040Z","submitted_at":"2024-12-02T18:28:18Z","title":"HackSynth: LLM Agent and Evaluation Framework for Autonomous Penetration Testing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01778","snapshot_observed_at":"2026-08-04T01:33:20.837262Z","title":"Hacksynth: Llm agent and evaluation framework for autonomous penetration testing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:20.837262Z"},"links":{"cited_paper":"/paper/2412.01778","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:db605fe41e7087cdf9e4e353329b446580593d23c88ecbb77403f10f60660c66","observation_id":"5d41388c-3db1-4e58-bb07-d8b86d680402","resolution":{"observed_at":"2026-08-04T01:33:20.837262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17332","last_updated":"2025-06-24T04:10:59Z","snapshot_observed_at":"2026-08-21T16:35:36.541328Z","submitted_at":"2025-03-21T17:32:32Z","title":"CVE-Bench: A Benchmark for AI Agents' Ability to Exploit Real-World Web Application Vulnerabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17332","snapshot_observed_at":"2026-08-04T01:33:20.873642Z","title":"Cve-bench: A benchmark for ai agents’ ability to exploit real-world web application vulnerabilities","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:20.873642Z"},"links":{"cited_paper":"/paper/2503.17332","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:3384397a46b831cc40b52cc6c18a5cead2c7acd9c24c46a541c4de6ca5c9be83","observation_id":"77fa3257-b6a1-4c4b-96ae-57bdf59e429c","resolution":{"observed_at":"2026-08-04T01:33:20.873642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.21497","last_updated":"2026-04-29T09:42:36Z","snapshot_observed_at":"2026-08-17T16:00:48.377482Z","submitted_at":"2026-04-29T09:42:36Z","title":"Autonomous LLM Agents & CTFs: A Second Look","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.21497","snapshot_observed_at":"2026-08-04T01:33:20.956536Z","title":"Autonomous llm agents & ctfs: A second look","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:20.956536Z"},"links":{"cited_paper":"/paper/2605.21497","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:6b57e80b7920da76c0f0607b99364bebb1f0c010ea8f4b47f4bf18a4bdaf047f","observation_id":"ac68106d-a200-4299-b430-4ecd33b67f01","resolution":{"observed_at":"2026-08-04T01:33:20.956536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:21.075351Z","title":"Red alarm for pre-trained models: Universal vulnerability to neuron-level backdoor attacks.Machine Intelligence Research, 20(2):180–193, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:21.075351Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:816a2c7bbf02bb4be1d0a138e72769c20c05abd59d8add8616399746748cc800","observation_id":"9cc1a18c-1e2c-41c4-b276-72bb55b5e9b8","resolution":{"observed_at":"2026-08-04T01:33:21.075351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10931","last_updated":"2025-05-11T03:59:37Z","snapshot_observed_at":"2026-08-16T12:58:05.321157Z","submitted_at":"2025-02-15T23:43:18Z","title":"D-CIPHER: Dynamic Collaborative Intelligent Multi-Agent System with Planner and Heterogeneous Executors for Offensive Security","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10931","snapshot_observed_at":"2026-08-04T01:33:21.152871Z","title":"D-cipher: Dynamic collaborative intelligent multi-agent system with planner and heterogeneous executors for offensive security","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:21.152871Z"},"links":{"cited_paper":"/paper/2502.10931","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:97f630e7e85fdd9e9c71f83aacd9d776a11618b3d4fb2539477f6dfb06a1cfb0","observation_id":"cbc41083-399e-4a16-a41b-ea52a7d7f608","resolution":{"observed_at":"2026-08-04T01:33:21.152871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02180","last_updated":"2025-07-18T19:01:58Z","snapshot_observed_at":"2026-08-15T04:46:36.603914Z","submitted_at":"2025-02-04T09:54:24Z","title":"The Elicitation Game: Evaluating Capability Elicitation Techniques","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02180","snapshot_observed_at":"2026-08-04T01:33:21.186887Z","title":"The elicitation game: Evaluating capability elicitation techniques","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:21.186887Z"},"links":{"cited_paper":"/paper/2502.02180","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:7c363a23d7de5159325353b802c11b592412e0ccd1908460bc492791fab40635","observation_id":"7ccb1427-293a-4aa8-a546-596bf210a9f8","resolution":{"observed_at":"2026-08-04T01:33:21.186887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.20255","last_updated":"2026-08-07T14:28:39Z","snapshot_observed_at":"2026-08-15T22:17:51.854912Z","submitted_at":"2026-07-22T15:13:15Z","title":"The Ethics of Autonomous AI Agents for Offensive Security","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.20255","snapshot_observed_at":"2026-08-04T01:33:21.238018Z","title":"The ethics of autonomous ai agents for offensive security","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:21.238018Z"},"links":{"cited_paper":"/paper/2607.20255","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:cf6ba104e77f9b3cf5346a0027d6e4f76419123205d32d940f452733420a2e6a","observation_id":"bd173fc8-e5a0-4536-b93a-b276c16f0f1f","resolution":{"observed_at":"2026-08-04T01:33:21.238018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:21.347700Z","title":"Detecting sleeper agents in large language models via semantic drift analysis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:21.347700Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:534cbf97e1f29082a1b2df22c6cf1567b083b68cec674f0796c5bf9b1e8d6398","observation_id":"6b100780-976d-4fa9-bd38-5599323fde4a","resolution":{"observed_at":"2026-08-04T01:33:21.347700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10162","last_updated":"2024-06-29T00:28:47Z","snapshot_observed_at":"2026-08-18T14:49:13.384384Z","submitted_at":"2024-06-14T16:26:20Z","title":"Sycophancy to Subterfuge: Investigating Reward-Tampering in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10162","snapshot_observed_at":"2026-08-04T01:33:21.407962Z","title":"Bowman, Ethan Perez, and Evan Hubinger","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:21.407962Z"},"links":{"cited_paper":"/paper/2406.10162","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:76d8636f4fc0bff080ff7495b2a59bac5fb7f4dffe644663938f874e8707dd70","observation_id":"23bf9427-7031-48c6-b773-124b802ec3d5","resolution":{"observed_at":"2026-08-04T01:33:21.407962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:21.556074Z","title":"Towards understanding sycophancy in language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:21.556074Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:859b8f99409484a9d023ae4ea3aed1fb63caa37a7aae3bdbcf66f1887d1bcea5","observation_id":"cf133028-860c-446b-a7c8-1e6388544aa3","resolution":{"observed_at":"2026-08-04T01:33:21.556074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:21.715416Z","title":"Sharkey, Jacob Pfau, and David Krueger","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:21.715416Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:fd01bae5b90f4d6cd8f9c6550ca1da17d853d2375019b31468d0c51ba9fdb4b7","observation_id":"00bbf6b3-a325-4e17-b2fe-ca84d8d26d1b","resolution":{"observed_at":"2026-08-04T01:33:21.715416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.01820","last_updated":"2021-12-01T11:22:52Z","snapshot_observed_at":"2026-08-17T12:23:45.330984Z","submitted_at":"2019-06-05T04:43:25Z","title":"Risks from Learned Optimization in Advanced Machine Learning Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.01820","snapshot_observed_at":"2026-08-04T01:33:21.820084Z","title":"Risks from learned optimization in advanced machine learning systems","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:21.820084Z"},"links":{"cited_paper":"/paper/1906.01820","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:0daa8f8a36b0f97dee2d62a0a0f113806b461f1913af8b5d7115ab143a93d9b0","observation_id":"c3cfefee-288d-4ff4-9887-e636ef2f72c4","resolution":{"observed_at":"2026-08-04T01:33:21.820084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06528","last_updated":"2023-04-13T13:29:01Z","snapshot_observed_at":"2026-08-16T20:58:46.993831Z","submitted_at":"2023-04-13T13:29:01Z","title":"Power-seeking can be probable and predictive for trained agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06528","snapshot_observed_at":"2026-08-04T01:33:21.933113Z","title":"Power-seeking can be probable and predictive for trained agents","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:21.933113Z"},"links":{"cited_paper":"/paper/2304.06528","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:44080aa5ae8e2bea7e059f0c486fafabc1ee2e2818a0e95daba28f0778b985f6","observation_id":"630909b5-2abe-483a-92f6-bb7e82d13312","resolution":{"observed_at":"2026-08-04T01:33:21.933113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04490","last_updated":"2024-10-06T14:09:54Z","snapshot_observed_at":"2026-08-19T03:09:42.075176Z","submitted_at":"2024-10-06T14:09:54Z","title":"A Large-Scale Exploit Instrumentation Study of AI/ML Supply Chain Attacks in Hugging Face Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04490","snapshot_observed_at":"2026-08-04T01:33:22.018563Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:22.018563Z"},"links":{"cited_paper":"/paper/2410.04490","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:c09298f49061960159fb2e637ea0e9c04592a78f6c9549e4207cdb67f3074a99","observation_id":"d5cca33b-e34b-4e15-9214-34a7f78f3903","resolution":{"observed_at":"2026-08-04T01:33:22.018563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:22.148720Z","title":"Safepickle: Robust and generic ml detection of malicious pickle-based ml models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:22.148720Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:1eb56918f9182961dfb2ad19009a302560a5bf62b24340cd2ef4b89289ca8de9","observation_id":"0ed56abe-7d94-4aba-8aa7-9dbebbfa0c55","resolution":{"observed_at":"2026-08-04T01:33:22.148720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:22.266658Z","title":"Kellas, Neophytos Christou, Wenxin Jiang, Penghui Li, Laurent Simon, Yaniv David, Vasileios P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:22.266658Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:a7fd195197b888b1024262f3e29774a16b61dba052e5fcdf1e7677e3232fb3cf","observation_id":"140c0c9b-d1e4-4c7c-9c76-7083d3a73d4a","resolution":{"observed_at":"2026-08-04T01:33:22.266658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:22.337560Z","title":"Defensive refusal bias: How safety alignment fails cyber defenders","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:22.337560Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:29fe75a84b4be32f418164b4f238aa00640e1641c8e46e789059654e06ea6ff5","observation_id":"e48605d9-f6ca-4044-a329-935c5173d725","resolution":{"observed_at":"2026-08-04T01:33:22.337560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:22.453572Z","title":"Zico Kolter","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:22.453572Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:d2cf98e4d0dda563a46c7bb9d8370362bf6f76d0fa701b75d16dff48b78d6794","observation_id":"68949237-313f-4188-9bcc-61cfe33c18de","resolution":{"observed_at":"2026-08-04T01:33:22.453572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11183","last_updated":"2025-01-19T21:49:42Z","snapshot_observed_at":"2026-08-17T08:45:50.203241Z","submitted_at":"2025-01-19T21:49:42Z","title":"Can Safety Fine-Tuning Be More Principled? Lessons Learned from Cybersecurity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11183","snapshot_observed_at":"2026-08-04T01:33:22.553666Z","title":"Can safety fine-tuning be more principled? lessons learned from cybersecurity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:22.553666Z"},"links":{"cited_paper":"/paper/2501.11183","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:e0e46e0b1b8c68272a3f0b8c58ec62ab76f2af1e7b12a4e94dc5c714d5d6b369","observation_id":"7c604844-ba65-42fb-a698-1b18614ba36c","resolution":{"observed_at":"2026-08-04T01:33:22.553666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.17413","last_updated":"2026-05-17T12:18:20Z","snapshot_observed_at":"2026-08-16T19:57:10.274787Z","submitted_at":"2026-05-17T12:18:20Z","title":"Ablating Safety: Mechanisms for Removing Alignment in Language Models for Security Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.17413","snapshot_observed_at":"2026-08-04T01:33:22.661751Z","title":"Ablating safety: Mechanisms for removing alignment in language models for security applications","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:22.661751Z"},"links":{"cited_paper":"/paper/2605.17413","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:84013b74e65e7512630feff8404bc7af27409f2241595d532d234dfd4577ee31","observation_id":"bc1711a2-3954-4e0d-bf5d-70cbf9104ef4","resolution":{"observed_at":"2026-08-04T01:33:22.661751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11969","last_updated":"2025-04-17T18:36:08Z","snapshot_observed_at":"2026-08-20T20:37:30.633701Z","submitted_at":"2024-07-16T17:59:55Z","title":"Does Refusal Training in LLMs Generalize to the Past Tense?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11969","snapshot_observed_at":"2026-08-04T01:33:22.755140Z","title":"Does refusal training in llms generalize to the past tense? arXiv preprint, arXiv:2407.11969, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:22.755140Z"},"links":{"cited_paper":"/paper/2407.11969","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:50555f61b455ba1d14117472c02a536637bccc919104734b8c1fc46f8b59e87f","observation_id":"d8cbb957-cfe3-4bc0-bdc4-d4da4bd18ae6","resolution":{"observed_at":"2026-08-04T01:33:22.755140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17109","last_updated":"2025-05-21T11:35:52Z","snapshot_observed_at":"2026-08-18T18:03:24.448674Z","submitted_at":"2025-05-21T11:35:52Z","title":"Mitigating Cyber Risk in the Age of Open-Weight LLMs: Policy Gaps and Technical Realities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17109","snapshot_observed_at":"2026-08-04T01:33:22.871161Z","title":"Mitigating cyber risk in the age of open-weight llms: Policy gaps and technical realities","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:22.871161Z"},"links":{"cited_paper":"/paper/2505.17109","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:b9f0564089350249363816a162ffa234e574f648863ec93dfe941f8de23fec70","observation_id":"5612304a-ed00-4cd8-ba7e-555bb632f2d5","resolution":{"observed_at":"2026-08-04T01:33:22.871161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27321","last_updated":"2026-04-30T02:06:46Z","snapshot_observed_at":"2026-08-06T15:08:48.961156Z","submitted_at":"2026-04-30T02:06:46Z","title":"Toward Autonomous SOC Operations: End-to-End LLM Framework for Threat Detection, Query Generation, and Resolution in Security Operations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27321","snapshot_observed_at":"2026-08-04T01:33:22.974747Z","title":"Toward autonomous soc operations: End-to-end llm framework for threat detection, query generation, and resolution in security operations","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:22.974747Z"},"links":{"cited_paper":"/paper/2604.27321","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:0b28d949af9f2c41b49294f34dedebef73c1edf1b6ed92440642d3efafe98037","observation_id":"329b84a3-df99-4980-bf7a-2c45855bccff","resolution":{"observed_at":"2026-08-04T01:33:22.974747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:23.103617Z","title":"Llms in the soc: An empirical study of human-ai collaboration in security operations centres","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:23.103617Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:3ccf06535e9ea7fc90bd907c5bcbd5272d4f3b303773d54b2a6c17a48a343e0e","observation_id":"460abc09-8e73-473b-b5d1-07f7779152cb","resolution":{"observed_at":"2026-08-04T01:33:23.103617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:23.250350Z","title":"Cortex: Collaborative llm agents for high-stakes alert triage","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:23.250350Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:e3d9b4960bc6267ce5fcb0d51b09f03782fcdd3c3ed7cf57b4899a44f923de0e","observation_id":"ef46b858-c99f-4c45-a030-a6406fbf9b99","resolution":{"observed_at":"2026-08-04T01:33:23.250350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13919","last_updated":"2025-02-10T22:06:36Z","snapshot_observed_at":"2026-08-16T13:08:29.724110Z","submitted_at":"2024-10-17T09:25:28Z","title":"LLM Agent Honeypot: Monitoring AI Hacking Agents in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13919","snapshot_observed_at":"2026-08-04T01:33:23.376610Z","title":"Llm agent honeypot: Monitoring ai hacking agents in the wild","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:23.376610Z"},"links":{"cited_paper":"/paper/2410.13919","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:67e69c19c43a246b515024d049b211ffdf3ce4ae55b9f735fc7922ff4057de52","observation_id":"8e6f95e3-c039-4e88-acb4-94423dc28edb","resolution":{"observed_at":"2026-08-04T01:33:23.376610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11839","last_updated":"2026-05-03T06:25:46Z","snapshot_observed_at":"2026-08-11T09:26:08.834282Z","submitted_at":"2026-04-12T13:10:56Z","title":"Beyond Static Sandboxing: Learned Capability Governance for Autonomous AI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11839","snapshot_observed_at":"2026-08-04T01:33:23.511579Z","title":"Beyond static sandboxing: Learned capability governance for autonomous ai agents","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:23.511579Z"},"links":{"cited_paper":"/paper/2604.11839","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:31d36caf6803b0b0d6972900194bdca51548da14b9653df3870e55cca445e4fe","observation_id":"16cdcf37-6087-450f-bae1-f742de132164","resolution":{"observed_at":"2026-08-04T01:33:23.511579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.20023","last_updated":"2026-07-07T12:24:40Z","snapshot_observed_at":"2026-08-04T15:59:37.484753Z","submitted_at":"2026-06-18T09:54:48Z","title":"When Lower Privileges Suffice: Investigating Over-Privileged Tool Selection in LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.20023","snapshot_observed_at":"2026-08-04T01:33:23.584695Z","title":"When lower privileges suffice: Investigating over-privileged tool selection in llm agents","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:23.584695Z"},"links":{"cited_paper":"/paper/2606.20023","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:640569cee2fe1db507f6895d3837638a67a7aa72e502b148c7368af7ec735496","observation_id":"6cc9fd8e-d5df-408c-add9-3405764624a0","resolution":{"observed_at":"2026-08-04T01:33:23.584695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:23.811905Z","title":"Audit trails for accountability in large language models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:23.811905Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:a2f3f264ddee2351ee83f730a727ea8aa609e977844d0dd0ce586dd3a14a0c9f","observation_id":"8f1f32fe-2138-41c1-a2c7-95e9c5a26176","resolution":{"observed_at":"2026-08-04T01:33:23.811905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23425","last_updated":"2026-04-25T19:41:00Z","snapshot_observed_at":"2026-08-14T23:21:59.858276Z","submitted_at":"2026-04-25T19:41:00Z","title":"When the Agent Is the Adversary: Architectural Requirements for Agentic AI Containment After the April 2026 Frontier Model Escape","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.23425","snapshot_observed_at":"2026-08-04T01:33:23.914719Z","title":"When the agent is the adversary: Architectural requirements for agentic ai containment after the april 2026 frontier model escape","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:23.914719Z"},"links":{"cited_paper":"/paper/2604.23425","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:7327cefb78ded0f6a0965c35f122e4381339aa242e9bb46d9f769cc4dcdf669d","observation_id":"9d363e54-187e-4cbf-9f5e-b77d655ef997","resolution":{"observed_at":"2026-08-04T01:33:23.914719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:23.981127Z","title":"Red teaming language models with language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:23.981127Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:6222d6291cb681331b9542c584ac90d9b928b3a97a2bc082a73878e005130d21","observation_id":"a8adfe07-266b-47cd-9b00-ee440303083b","resolution":{"observed_at":"2026-08-04T01:33:23.981127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10986","last_updated":"2024-05-15T20:28:15Z","snapshot_observed_at":"2026-08-20T17:33:36.327360Z","submitted_at":"2024-05-15T20:28:15Z","title":"Benchmark Early and Red Team Often: A Framework for Assessing and Managing Dual-Use Hazards of AI Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10986","snapshot_observed_at":"2026-08-04T01:33:24.049880Z","title":"Barrett, Krystal Jackson, Evan R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:24.049880Z"},"links":{"cited_paper":"/paper/2405.10986","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:f2ba96beae06a8c7ccd85a4140feedb9e14a593f5901b22148971cb229e13ad5","observation_id":"f785cad0-e52a-40c0-8495-3ea4540b3bac","resolution":{"observed_at":"2026-08-04T01:33:24.049880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:24.200575Z","title":"Beyond over-refusal: Scenario-based diagnostics and post-hoc mitigation for exaggerated refusals in llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:24.200575Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:e08601a2a7fe063586cf614b4343061636d0f32148acdc40cdd97817489d7f60","observation_id":"779d00c6-df70-463f-b909-40c2248125ec","resolution":{"observed_at":"2026-08-04T01:33:24.200575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-14T05:42:29.067319Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-04T01:33:24.370083Z","title":"Language models (mostly) know what they know","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:24.370083Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:b1f1c912cd262a9b7631984de3cc1e095463cdbef142643b09688ef81d560829","observation_id":"dd1b7c70-9ec8-4e82-a20e-6edc3519abb7","resolution":{"observed_at":"2026-08-04T01:33:24.370083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:24.587422Z","title":"Anthropic responsible scaling policy","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:24.587422Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:aefa0443bd733b4c2ec634e785b2bfce3e59144339728e96ed4590cfce5608b0","observation_id":"e33ca357-93fa-4709-846a-b568af6dcbb6","resolution":{"observed_at":"2026-08-04T01:33:24.587422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:24.684332Z","title":"Openai preparedness framework","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:24.684332Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:49369e4a55f3003458b4292e509031672e6140f2e15b537928a12ef70894f32c","observation_id":"1a70ba59-cc93-4470-af08-5ff72ffaa862","resolution":{"observed_at":"2026-08-04T01:33:24.684332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:24.859178Z","title":"EU AI Act, article 15: Accuracy, robustness and cybersecurity.https: //ai-act-service-desk.ec.europa.eu/en/ai-act/article-15, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:24.859178Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:a83f6e10e2e402f0e92a96aaa4e305ef5e921ffd702191f34a4c72e57b58cea7","observation_id":"f3b815b3-444d-429b-a56d-6058a1f80d04","resolution":{"observed_at":"2026-08-04T01:33:24.859178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T01:33:25.006611Z","title":"Managing advanced cyber risks in frontier AI frameworks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-04T01:33:25.006611Z"},"links":{"citing_paper":"/paper/2607.25379"},"observation_digest":"sha256:f1041965dcea9d8f5772390c9c56e7d3b5b3c66933493eb20a0b67c813b19619","observation_id":"8daed7da-7dc5-48f5-832f-9c22ea38c934","resolution":{"observed_at":"2026-08-04T01:33:25.006611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25379","last_updated":"2026-08-01T10:03:47Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-19T00:44:48.503034Z","submitted_at":"2026-07-28T07:34:37Z","title":"Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response"},"reference_resolution":{"displayed":97,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":97,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":97},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 97 of 97 outbound references and 0 inbound Pith citation observations for arXiv:2607.25379."}