Pith. sign in

Paper Citation Record · LEDGER

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation

As of 17 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 2 inbound Pith citation observations for arXiv:2505.01065.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.01065 v1

Coverage vector

measured 18 of 18 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-16T04:29:54.244745Z

measured 20 of 20 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-11T14:59:21.115774Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-11T14:59:21.606635Z

Reference resolution

18 of 18 outbound references displayed

  • verified exact0
  • verified fuzzy17
  • unresolved1
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation ea9ca3b8-dc0a-477a-ae2d-83c8b015b3c6 · outbound

This paper cites A survey on software vulnerability exploitability assessment,.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation A survey on software vulnerability exploitability assessment,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.588511Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.163038Z digest=sha256:424d4977286b7db4970d643d27d47f5a0b78fc3af69e0bba403ee84c0c50646b

Observation 16e2ca52-90ce-458c-94bf-026c5cb15b0d · outbound

This paper cites Koobe: Towards facilitating exploit generation of kernel out-of-bounds write vulnerabilities,.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Koobe: Towards facilitating exploit generation of kernel out-of-bounds write vulnerabilities,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.574838Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.168097Z digest=sha256:4e0491db8f08c6c6f921e193932f3e638978ea47086957ec9056b965eaf9c9d0

Observation 25bbbe80-0a6f-49a1-88c5-64b6feb05401 · outbound

This paper cites Automatic generation of control flow hijacking exploits for software vulnerabilities,.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Automatic generation of control flow hijacking exploits for software vulnerabilities,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.561551Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.173086Z digest=sha256:bb63dd496269d13bf72ffb334dbeff14bc8a46fc934282ea4b7febc25594ac8f

Observation f991f8a0-3dd6-4364-9169-7b98be97007c · outbound

This paper cites Automatic patch-based exploit generation is possible: Techniques and implications.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Automatic patch-based exploit generation is possible: Techniques and implications

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.548724Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.178368Z digest=sha256:e3fa232536a304eed65a546e2f1dcc2e3b650c18dbe75e897f15e8672f168ccb

Observation af88af8c-f82d-468f-9624-ef0d84488642 · outbound

This paper cites Aeg: Automatic exploit generation,.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Aeg: Automatic exploit generation,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.534722Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.182620Z digest=sha256:426f79e5225d94cfc8d95397ae4e66ac5432d6af8306771ea2825789ee1aa8c0

Observation a1ccd026-348e-47d9-b9bd-ed4e639e840e · outbound

This paper cites Fuze: Towards facilitating exploit generation for kernel use-after-free vulnerabilities,.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Fuze: Towards facilitating exploit generation for kernel use-after-free vulnerabilities,

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.520615Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.187542Z digest=sha256:18d7f57b60a5f7b16588c7b88757e24767d333fcccdd99401b4412636a92c2c1

Observation 4a17078d-5c16-4b41-adef-c2e4e0ccbab6 · outbound

This paper cites Automated exploit generation for stack buffer overflow vulnerabilities,.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Automated exploit generation for stack buffer overflow vulnerabilities,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.507338Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.192865Z digest=sha256:94fae4b5768304f2fbfbf24f87cef4cc94b1ca0d0d6748daf461b48de630de24

Observation 2e8041ab-56d3-4dfc-92df-a5c2665baff0 · outbound

This paper cites Automatic exploit generation for buffer overflow vulnerabilities,.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Automatic exploit generation for buffer overflow vulnerabilities,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.493371Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.198553Z digest=sha256:5604afe04b43d962fe070123e6e912d348700ab1c76145dfd5303ebd5246e118

Observation 76b3eb8c-256e-4371-8fea-17a96ecd9066 · outbound

This paper cites Toward automated exploit generation for known vulnerabilities in open-source libraries,.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Toward automated exploit generation for known vulnerabilities in open-source libraries,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.478717Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.202744Z digest=sha256:d48d8809f2e5e297e2d9f9bb21238bbcb8681f1d811f22cc69dd1d05c0edc48b

Observation 57b085b7-0d98-4787-ad42-4e4bedee8e43 · outbound

This paper cites Large language models for software engineering: A systematic literature review,.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Large language models for software engineering: A systematic literature review,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.465079Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.207949Z digest=sha256:f5c9f3df72ec3e1c6490cd8a7c93ae37600b09867739efe3483601d482f5de87

Observation 4648c16b-1e36-4b5c-8496-9140c91bebbc · outbound

This paper cites How well does llm generate security tests?.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation How well does llm generate security tests?

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-16T04:29:54.212225Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T04:29:54.212225Z digest=sha256:71f322511aa5b778df65cb5b70d51317c4cb991b7097bb03f86d396633d9e3c9

Observation 84c0efb3-9eb9-4c85-ade5-aef218334377 · outbound

This paper cites Pentestgpt: Evaluating and harnessing large language models for automated penetration testing,.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Pentestgpt: Evaluating and harnessing large language models for automated penetration testing,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.450317Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.217377Z digest=sha256:9c0a46394aca44a5b02129b3c1d897ec3d7a448fa2581d3651d115501304eb5c

Observation e2d6bdbf-d8b5-4131-b894-f73ed706bfe2 · outbound

This paper cites Leveraging semantic relations in code and data to enhance taint analysis of embedded systems,.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Leveraging semantic relations in code and data to enhance taint analysis of embedded systems,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.434757Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.221650Z digest=sha256:51f7c4c1fbcf7339f1333391b0658d3d767b169d9110e76c38038a938e025d9f

Observation 6a6b88f9-af50-441c-8202-a9028e85e0ba · outbound

This paper cites Seed labs,.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Seed labs,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.419720Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.227026Z digest=sha256:b76763e69958d218ad909fca894ae0a4288feff17ba9cf9c9d9c714bd2c251b1

Observation e00e9e8c-7c12-4717-abe2-8dcdeef5fa09 · outbound

This paper cites Explaining neural scaling laws,.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Explaining neural scaling laws,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.404822Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.231160Z digest=sha256:d0b5ddbc730054dd57d74505c311cf9e02be0c4b4bfc61532ecefd15a185a311

Observation d0d970f3-6ec2-457e-b47f-0de6bb92b7e7 · outbound

This paper cites A comprehensive study of jailbreak attack versus defense for large language models,.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation A comprehensive study of jailbreak attack versus defense for large language models,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.390071Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.235896Z digest=sha256:34b45064a8de6822efca000d5a37400ddb544e19e105ba700a484adece9552f6

Observation 74e11491-6780-4e73-9193-2b2cf2983e19 · outbound

This paper cites Get up and running with large language models.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Get up and running with large language models

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.362443Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.244745Z digest=sha256:66c497a32b95fe200c46f4e36c8100e69b0f28b670101cc8ffb48d6d81b6381e

Observation d71657a1-e4b8-4071-92d6-167f4d0875c4 · outbound

This paper cites Available: https://api.semanticscholar.org/CorpusID: 267770234.

Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation Available: https://api.semanticscholar.org/CorpusID: 267770234

Reference 2024

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T04:29:54.375589Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-16T04:29:54.240107Z digest=sha256:4c915f4b4343b5e338dac4d0afb4ee59fc1817142bb3884d8b7d1dcacfab052a

Pith citing papers

Observation a750dab8-940a-44e0-bd63-468671c645fe · inbound

Knowdit: Agentic Smart Contract Vulnerability Detection with Auditing Knowledge Summarization cites this paper.

Knowdit: Agentic Smart Contract Vulnerability Detection with Auditing Knowledge Summarization Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation

Reference 19

Resolution
unresolved
no resolver link, observed 2026-07-13T17:39:42.764726Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T17:39:42.764726Z digest=sha256:a8cab8ebbbbec128c28e959cd347dc8b69e3f272e67eb20c51be6a8f510a9c8f

Observation c9316492-b658-4e01-b4c2-1351facc0ad4 · inbound

From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts cites this paper.

From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation

Reference 4

Resolution
verified exact
local_arxiv, observed 2026-08-11T14:59:21.609935Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-08-11T14:59:21.115774Z digest=sha256:6e7fafdb37c4fecd35b0f690b6e4b585c0c5088556980a6dd5a9902585f637ed