{"as_of":"2026-08-09T15:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5c2326a035994a1e0d7a182024303f2a26dcd56983c35228646897a5698aa337","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T05:32:24.938897Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T15:38:33.520795Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-08-08T23:10:10.953295Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04227","last_updated":"2025-09-11T12:26:33Z","snapshot_observed_at":"2026-08-08T23:03:11.306261Z","submitted_at":"2025-02-06T17:12:43Z","title":"Can LLMs Hack Enterprise Networks? Autonomous Assumed Breach Penetration-Testing Active Directory Networks","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T23:10:10.953295Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2502.04227"},"observation_digest":"sha256:5c6e0bf989ed4a512795109276fe49b865c412fff466393b7589db9187febcd5","observation_id":"de35d2ad-a344-45fa-8198-e4ca84011687","resolution":{"observed_at":"2026-08-08T23:10:10.953295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-08-09T05:32:24.938897Z","title":"Available: https://arxiv.org/abs/2410.03225","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.18474","last_updated":"2025-02-05T14:27:17Z","snapshot_observed_at":"2026-08-09T05:27:19.931068Z","submitted_at":"2025-02-05T14:27:17Z","title":"A Contemporary Survey of Large Language Model Assisted Program Analysis","version":1},"reference_index":161,"source":"pdf_text","source_observed_at":"2026-08-09T05:32:24.938897Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2502.18474"},"observation_digest":"sha256:d443daec67a807e0ebdf459bad74ed42288f753c741f589739db25c7866be49e","observation_id":"4abde3c0-a8d4-4c57-a7a8-53308416d707","resolution":{"observed_at":"2026-08-09T05:32:24.938897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-08-07T00:48:15.439899Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12594","last_updated":"2025-06-14T18:19:05Z","snapshot_observed_at":"2026-08-07T11:53:13.790399Z","submitted_at":"2025-06-14T18:19:05Z","title":"A Comprehensive Survey of Deep Research: Systems, Methodologies, and Applications","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T00:48:15.439899Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2506.12594"},"observation_digest":"sha256:71c47c6f281013f096680e43cfe35cb8be1cab28fd4525054a11bf0378e227dc","observation_id":"ff71ded2-2ba4-4491-bc5e-b6dc976527d6","resolution":{"observed_at":"2026-08-07T00:48:15.439899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-08-06T21:10:04.455902Z","title":"Autopenbench: Benchmarking generative agents for penetration testing, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00829","last_updated":"2025-07-01T15:01:18Z","snapshot_observed_at":"2026-08-08T03:47:45.535102Z","submitted_at":"2025-07-01T15:01:18Z","title":"On the Surprising Efficacy of LLMs for Penetration-Testing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:10:04.455902Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2507.00829"},"observation_digest":"sha256:134ba38c689672633dd5c9c41a0580996168accfc4312dfc5d0ceaadfb922dfd","observation_id":"4d7d9d3d-5ce4-418b-a742-22dd271fc41d","resolution":{"observed_at":"2026-08-06T21:10:04.455902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2509.06921","last_updated":"2026-04-15T05:15:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-08T17:33:59Z","title":"Neuro-Symbolic AI for Cybersecurity: State of the Art, Challenges, and Opportunities","version":2},"reference_index":174,"source":"pdf_text","source_observed_at":"2026-05-18T18:04:09.528381Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2509.06921"},"observation_digest":"sha256:2030de0e44b3407acc4ca4e19166b285972ca81092336c08ea0252450629854f","observation_id":"27bacd1b-08dd-410b-a165-3744a2b61ff2","resolution":{"observed_at":"2026-05-18T18:06:42.909055Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-08-04T00:09:33.496022Z","title":"AutoPenBench: Bench- marking Generative Agents for Penetration Testing, October 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.02780","last_updated":"2026-02-23T13:17:25Z","snapshot_observed_at":"2026-08-08T06:24:41.301734Z","submitted_at":"2025-11-04T18:03:12Z","title":"PoCo: Agentic Proof-of-Concept Exploit Generation for Smart Contracts","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T00:09:33.496022Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2511.02780"},"observation_digest":"sha256:9c0c0cdbd08b09d9d8071b351f8376be96862044b33c5b34abe13f8b19506706","observation_id":"d76c0297-a11c-4260-9d24-07155462fd0b","resolution":{"observed_at":"2026-08-04T00:09:33.496022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2512.22753","last_updated":"2026-04-22T21:48:07Z","snapshot_observed_at":"2026-08-08T22:14:34.218223Z","submitted_at":"2025-12-28T02:55:49Z","title":"From Rookie to Expert: Manipulating LLMs for Automated Vulnerability Exploitation in Enterprise Software","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T20:02:47.746439Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2512.22753"},"observation_digest":"sha256:36ae9b6b92c87b4acf0305d194d03cf45acf2ffdb480db76a523589cc3e9ba4e","observation_id":"ccc1f7da-0c8b-46ed-82fe-805fde92620c","resolution":{"observed_at":"2026-05-16T20:03:22.151429Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2605.06486","last_updated":"2026-05-07T16:07:41Z","snapshot_observed_at":"2026-08-02T21:44:55.115745Z","submitted_at":"2026-05-07T16:07:41Z","title":"Autonomous Adversary: Red-Teaming in the age of LLM","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T09:09:58.566171Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2605.06486"},"observation_digest":"sha256:4ee7acfbc7c45c90f5d52fecfd92acef1b0ff86962bf346f68285d0d00afa11f","observation_id":"a0829395-8fbf-40f8-b2ff-564d4ff23ae3","resolution":{"observed_at":"2026-05-11T20:26:10.541154Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2605.10834","last_updated":"2026-07-28T07:30:21Z","snapshot_observed_at":"2026-08-02T14:32:21.223586Z","submitted_at":"2026-05-11T16:50:00Z","title":"From Controlled to the Wild: Evaluation of Pentesting Agents for the Real-World","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T03:34:55.538935Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2605.10834"},"observation_digest":"sha256:c5b4571aef06bacbe3652464c0fd1abc304efd0f588de311c6a6eebf3eb33394","observation_id":"7f0784d0-b838-488b-92e8-25ab5b550474","resolution":{"observed_at":"2026-05-12T07:16:27.683047Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-08-02T14:22:24.431295Z","title":"Siracusano, and Roberto Bifulco","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.10834","last_updated":"2026-07-28T07:30:21Z","snapshot_observed_at":"2026-08-02T14:32:21.223586Z","submitted_at":"2026-05-11T16:50:00Z","title":"From Controlled to the Wild: Evaluation of Pentesting Agents for the Real-World","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T14:22:24.431295Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2605.10834"},"observation_digest":"sha256:d0bb42834c313dff6bc93099123d786e059e6c85ff896fd34334de044c6930e0","observation_id":"9710babd-2c8b-4b92-8776-7d7167ff2f8c","resolution":{"observed_at":"2026-08-02T14:22:24.431295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2605.26195","last_updated":"2026-06-16T16:19:26Z","snapshot_observed_at":"2026-08-02T06:03:12.995535Z","submitted_at":"2026-05-25T16:26:59Z","title":"CyberEvolver: Structured Self-Evolution for Cybersecurity Agents On the Fly","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T21:19:59.005348Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2605.26195"},"observation_digest":"sha256:ce5942ffd113ce76ed0cb510d221d1c2164ae18ce8458313dee32dc38f425543","observation_id":"6b1e73b4-ee16-48fd-86f7-6f2e67d87f44","resolution":{"observed_at":"2026-06-29T21:23:59.018250Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2605.30096","last_updated":"2026-05-28T15:39:43Z","snapshot_observed_at":"2026-08-08T19:27:59.265761Z","submitted_at":"2026-05-28T15:39:43Z","title":"How Reliable Are AI Attackers Against a Fixed Vulnerable Target? A 400-Run Empirical Study of LLM Penetration Testing Consistency","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T06:53:48.841077Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2605.30096"},"observation_digest":"sha256:da506b4e0bc62d06abb2d600500645e24249cf8b2da80944d4ff85743ef995da","observation_id":"ba9e09b6-a8cc-4093-ad41-4631de23ceca","resolution":{"observed_at":"2026-06-29T14:13:30.524834Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2606.13079","last_updated":"2026-06-29T13:15:12Z","snapshot_observed_at":"2026-08-03T16:41:34.392185Z","submitted_at":"2026-06-11T09:02:14Z","title":"The Emergence of Autonomous Penetration Capabilities in Large Language Model-Powered AI Systems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T06:25:17.298114Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2606.13079"},"observation_digest":"sha256:8155dcf6136760833a67bf097d4ce92b7f5672523ab6f2426e6b86a3a77eb59b","observation_id":"e90b2f68-dd9b-43ea-924c-728df9a05bfa","resolution":{"observed_at":"2026-07-03T15:38:33.522197Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing","version":2},"cited_work":{"arxiv_id":"2410.03225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03225","snapshot_observed_at":"2026-07-03T15:38:33.520795Z","title":"Autopenbench: Benchmarking generative agents for penetration testing","venue":null,"work_id":"f9c0c08d-19d1-475c-be87-d7e4ada7ca13","year":2024},"citing_paper":{"arxiv_id":"2606.13079","last_updated":"2026-06-29T13:15:12Z","snapshot_observed_at":"2026-08-03T16:41:34.392185Z","submitted_at":"2026-06-11T09:02:14Z","title":"The Emergence of Autonomous Penetration Capabilities in Large Language Model-Powered AI Systems","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T11:27:22.436981Z"},"links":{"cited_paper":"/paper/2410.03225","citing_paper":"/paper/2606.13079"},"observation_digest":"sha256:8e1c94bd28561f47529fccae39b0a56a88079e94144ec6e754749561556af8fd","observation_id":"f5fb2b92-04b1-4909-b1c4-7251da9723c6","resolution":{"observed_at":"2026-06-30T11:34:38.131562Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.03225/citation-record","integrity":"/paper/2410.03225/integrity","json":"/paper/2410.03225/citation-record.json","paper":"/paper/2410.03225"},"outbound":[],"paper":{"arxiv_id":"2410.03225","last_updated":"2024-10-28T17:05:27Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-09T03:25:28.000080Z","submitted_at":"2024-10-04T08:24:15Z","title":"AutoPenBench: Benchmarking Generative Agents for Penetration Testing"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2410.03225."}