Pith. sign in

Paper Citation Record · LEDGER

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models

As of 14 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 5 inbound Pith citation observations for arXiv:2501.01335.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2501.01335 v1

Coverage vector

measured 41 of 41 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-10T22:32:38.399736Z

measured 46 of 46 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 5 of 5 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-06-29T12:07:49.656453Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-06-29T12:13:26.857749Z

Reference resolution

41 of 41 outbound references displayed

  • verified exact0
  • verified fuzzy26
  • unresolved14
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 394d2da9-20a5-4d2f-aba0-97f28a9487d0 · outbound

This paper cites Attention is all you need,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Attention is all you need,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.900094Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.240388Z digest=sha256:ea939c42c354f52c89ee3ae3eddf250e6e26e2e91fc79c010ab18a9c23b801fb

Observation 85c47fea-b254-4483-94c5-8ed5bedf4865 · outbound

This paper cites BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.245105Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.245105Z digest=sha256:d66a334ab973cd3881188116f47aef4d81af37ec23a8597efb9afbba7997e19d

Observation 06334a4c-b326-40ff-b3a7-af985cfa448a · outbound

This paper cites GPT-4 Technical Report.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models GPT-4 Technical Report

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.249713Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.249713Z digest=sha256:eaa80847121aa693afbdb6ab46be7fbdb6b5a4b4c34a6e26e0739de9cc4f8ac9

Observation ee2b81a7-ce05-4e15-b14d-16675bc9ea02 · outbound

This paper cites Language models are few-shot learners,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Language models are few-shot learners,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.888463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.254162Z digest=sha256:74dff1c2e5a1c4b7a9e2f7c0a19a799512ec539e55b39506f3c500f17badd350

Observation 3779f392-0e1d-423c-8d16-43f14af15ec2 · outbound

This paper cites Scaling Laws for Neural Language Models.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Scaling Laws for Neural Language Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.258417Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.258417Z digest=sha256:3656eccc5010b55dff38871679e25b9b2d50e118af91058fa7b927d0098ab149

Observation bbf7f252-9a37-4b11-8356-e6d8a1eb7104 · outbound

This paper cites Emergent Abilities of Large Language Models.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Emergent Abilities of Large Language Models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.263658Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.263658Z digest=sha256:08d38d5d8ae90625e150e87127e5f74e1ac67a767b34894cde03132edd56e63a

Observation e5e4b5da-e15a-43ae-a213-53a99deabc98 · outbound

This paper cites User centric evaluation of code generation tools (invited paper),.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models User centric evaluation of code generation tools (invited paper),

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.875961Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.268314Z digest=sha256:0535e6e458c9900ca63aac3f86f1060e1ee0b21a8ab322bc59b58c9db4af98a0

Observation 1bfa694e-5319-4a42-a773-4fb2ed8ffbe3 · outbound

This paper cites Evaluating Large Language Models Trained on Code.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Evaluating Large Language Models Trained on Code

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.271863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.271863Z digest=sha256:8e3c2cfff1879f0bc62bbab6f47563f73d0c2953a180d8cc5170284a49a30c03

Observation 5cf78ff7-23cd-4a91-a0be-68661a85cfaf · outbound

This paper cites GitHub and OpenAI Launch a New AI Tool That Generates Its Own Code,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models GitHub and OpenAI Launch a New AI Tool That Generates Its Own Code,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.863430Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.275886Z digest=sha256:92c5f75ae91fe388b8254fa2fcf261b428469aa00eaa76980670a5c42a4567c2

Observation cfe53d0e-9895-4ba7-a6c3-9132f68cfcc7 · outbound

This paper cites Program Synthesis with Large Language Models.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Program Synthesis with Large Language Models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.283387Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.283387Z digest=sha256:3e876e39bd9e94230fb8f78baf5534feb3919987bfa2a20515e14b9de18138d6

Observation fb596840-b193-4ff7-aded-cea867d10a39 · outbound

This paper cites Available: https://www.theverge.com/2021/6/29/22555777/ github-openai-ai-tool-autocomplete-code.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Available: https://www.theverge.com/2021/6/29/22555777/ github-openai-ai-tool-autocomplete-code

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.849828Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.279679Z digest=sha256:7f5ad748b7149651cab91045a7cb99d18069910b0654b0d3fc75318b5ca52b6d

Observation 75b8d44c-00b9-44bb-8576-a849ba00d04b · outbound

This paper cites GitHub Copilot AI pair programmer: Asset or Liability?.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models GitHub Copilot AI pair programmer: Asset or Liability?

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.287350Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.287350Z digest=sha256:c5d9ea804bc6b76bdcafb037507a50f336e74c7542ffb4a6310f21a8a821ea91

Observation 795f1630-e2ec-4742-9d0b-8716ca40b5e3 · outbound

This paper cites From ChatGPT to ThreatGPT: Impact of Generative AI in Cybersecurity and Privacy,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models From ChatGPT to ThreatGPT: Impact of Generative AI in Cybersecurity and Privacy,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.836778Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.291668Z digest=sha256:9a6392eb9daf4a62207bdb840c1b8a14caad7113173a6555f8327e1833f975b0

Observation c28cd4b5-51d0-401b-9765-e887f8799e09 · outbound

This paper cites (2023, April) Jailbreaking Large Language Models: A Comprehensive Guide.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models (2023, April) Jailbreaking Large Language Models: A Comprehensive Guide

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.824499Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.295400Z digest=sha256:1539d111b181dac85b6ff8cd7f0d93c030c42d018abc68146d2240830513ef5c

Observation 23059078-f6ee-4f6e-9942-36d70484c918 · outbound

This paper cites Low-Resource Languages Jailbreak GPT-4,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Low-Resource Languages Jailbreak GPT-4,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.811814Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.299129Z digest=sha256:7f873627612cd4d2d3c0a764a2ce6206dea5c1b729fcc65a9c6946e20742222a

Observation 369f7a32-70d8-4ae1-bfd3-4521cd26ad8c · outbound

This paper cites Making Them Ask and Answer: Jail- breaking Large Language Models in Few Queries via Disguise and Reconstruction,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Making Them Ask and Answer: Jail- breaking Large Language Models in Few Queries via Disguise and Reconstruction,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.800544Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.302654Z digest=sha256:183eaa53edd2aff0b8a7d12d0e68db07b79a1630e7ef4b14711a24f1554ec406

Observation 47bb46b7-dc36-4e93-8da6-5b7728b6eb8f · outbound

This paper cites A Wolf in Sheep's Clothing: Generalized Nested Jailbreak Prompts can Fool Large Language Models Easily.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models A Wolf in Sheep's Clothing: Generalized Nested Jailbreak Prompts can Fool Large Language Models Easily

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.306228Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.306228Z digest=sha256:1bc00b5a4ca17cc942c127fcc1d9e37cf8efa64ebad3515ade9b68260a440ec1

Observation b65b8c4f-3271-444d-9564-7978ac20a2cb · outbound

This paper cites ArtPrompt: ASCII Art-based Jailbreak Attacks against Aligned LLMs.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models ArtPrompt: ASCII Art-based Jailbreak Attacks against Aligned LLMs

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.310299Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.310299Z digest=sha256:3817005b5d5f7e91b540a0f5e43ba9a82c955f98681fd20da63a7b46b3bf78d8

Observation a5f85662-b51c-4054-81a3-66a3acd0e78d · outbound

This paper cites WordGame: Efficient & Effective LLM Jailbreak via Simultaneous Obfuscation in Query and Response.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models WordGame: Efficient & Effective LLM Jailbreak via Simultaneous Obfuscation in Query and Response

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.314160Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.314160Z digest=sha256:e414fc736c741745e31995b19463f993a05448064331d9dbb9d32e39dc35818a

Observation 04f18928-7900-42da-8b72-6a48dea64be2 · outbound

This paper cites Jailbreaking Black Box Large Language Models in Twenty Queries.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Jailbreaking Black Box Large Language Models in Twenty Queries

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.318160Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.318160Z digest=sha256:81bb228d50d1f6f928b7b3bf3a09da2273f79eadc81096712db323f77dc06891

Observation aa658a1a-add4-4a07-b7cd-cdb01994be11 · outbound

This paper cites AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.322495Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.322495Z digest=sha256:911b040e216203f6cea07c44157dbc7e638c1fab8fec76d66e99a63c29b62b46

Observation 4585807e-2935-490f-8662-0a092b346e74 · outbound

This paper cites Universal and transferable adversarial attacks on aligned language models,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Universal and transferable adversarial attacks on aligned language models,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.326659Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.326659Z digest=sha256:1ef52b662453256a4b2bf555a6c0b3606fd180558eee20276390b1c951e41eb0

Observation b8610f2e-47ae-4cae-8659-e84485a13a41 · outbound

This paper cites HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.781864Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.330339Z digest=sha256:857a9f2289f2aae2fb9e866ae9ce4e89d6f3ae06267a6f5a7544b9093644bbe0

Observation 91792451-f15e-4212-ac6d-e8062af6ab99 · outbound

This paper cites Malicious tasks dataset,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Malicious tasks dataset,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.770146Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.334159Z digest=sha256:9835ff241c053e51b7da99984e3ae2068910e01461723a668bb3af3c6f12cca1

Observation 6f52abfc-b334-472d-8168-4543b6507443 · outbound

This paper cites ‘Do Anything Now’: Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models ‘Do Anything Now’: Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.759626Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.338012Z digest=sha256:8e0ff43f86dc1d087247d5396b8ea4ed16669295d74853253d4e74bf8d80c576

Observation c52494ba-cdcc-41c4-99f2-b71fbdefc1c4 · outbound

This paper cites Jailbreakv28k,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Jailbreakv28k,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.747605Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.341879Z digest=sha256:46b067470e555ea9ace5c783993c8496508bfc13ee870dbd43f804c80c6b7890

Observation 13453a22-50cd-4e52-a56f-ae30aa701761 · outbound

This paper cites Chatgpt-jailbreak-prompts,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Chatgpt-jailbreak-prompts,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.736401Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.345808Z digest=sha256:f79221e9efad44b50b752bf264372a2cec41fe1501281ecd76b06299dd06face

Observation bce99a5c-7eec-418d-9cd5-9c62ba89b05f · outbound

This paper cites Jailbreakhub,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Jailbreakhub,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.724915Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.349600Z digest=sha256:7e8bbebf40e96a473e89914b45760c80cfdd0de13f265d92e540c7caead9028e

Observation 75f2139a-ca16-4e1b-bccb-602ee3084b70 · outbound

This paper cites Malicious-llm-prompts-v4,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Malicious-llm-prompts-v4,

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.712709Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.353695Z digest=sha256:89129fbae17b5f6832bcf43d84dea91812318eaecce6e9e39b0f79571e7c070e

Observation 813ca809-fb8f-48d0-86d3-dc8786ddeae8 · outbound

This paper cites Prompt injection,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Prompt injection,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.701517Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.357477Z digest=sha256:22cffea3d001261fc16aae1eafaea1443d504085caa3461da7094d25ea8dd65c

Observation edf76cb9-b1cc-48ca-b7c7-8219466ebb49 · outbound

This paper cites Wahr ´eus, A.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Wahr ´eus, A

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.689917Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.361367Z digest=sha256:bc855b278331bd286298b5ac8086b31c6c890e3371a35b00d88758a5da633b1d

Observation b37494c0-383a-4279-9e11-7b440e425828 · outbound

This paper cites (2024) Homepage.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models (2024) Homepage

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.678044Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.365081Z digest=sha256:9446c65ef78e4718ba86a16a4e2ab541d60bf7b9d4312b25832c7a12080b0da7

Observation c2a3fb33-a72e-4548-bf02-df0a8b24220f · outbound

This paper cites Gemini: Google’s generative ai platform,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Gemini: Google’s generative ai platform,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.665469Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.369093Z digest=sha256:df66db6607b118849528ea6082fbdacd3d2ccfad80ae974c0c263aac9c3a7ea4

Observation f71cae31-1adb-4a68-be46-80463d21cf69 · outbound

This paper cites Claude: Anthropic’s AI Assistant,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Claude: Anthropic’s AI Assistant,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.651951Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.372809Z digest=sha256:1de0331b465a096a9dab7a7f6a902ba1d67ba6cc868b71858df67b1249a7eaec

Observation eda6621f-06da-498b-82a2-9325344c28ff · outbound

This paper cites GPT-4o Mini: Advancing Cost-Efficient Intelligence,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models GPT-4o Mini: Advancing Cost-Efficient Intelligence,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.639613Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.376584Z digest=sha256:7edd906e3c2d2fe99732c4f2a94a6278a2f44d41f1aa730a490f13c33fac112a

Observation fbeefd07-2889-4061-bd1a-4e0e912bf30d · outbound

This paper cites (2024) MECE Principle: Definition, Exam- ples, and Tips.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models (2024) MECE Principle: Definition, Exam- ples, and Tips

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.626742Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.380302Z digest=sha256:a0db4919f5d8df6c3757f57054d74ee584c52673eb735df3611af361779e2f31

Observation 7fd6d0aa-b977-4c09-a1f2-20e64604fe23 · outbound

This paper cites Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.384119Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.384119Z digest=sha256:f23ed5785a8c56373abc1259ad0040807f242d879782a7955037d4461a2d5e05

Observation 9574c9bd-f1c5-4e4c-883d-875c7300ae1d · outbound

This paper cites Leaderboards: Models,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Leaderboards: Models,

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.614072Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.388355Z digest=sha256:6b3115f272110d04256822925ebc0c0995234864e856abf3eed8b9957534fa08

Observation 9a4a2d54-4430-4c47-9ea6-615404516cc7 · outbound

This paper cites SELECT * FROM files WHERE filename = '{user_input}'.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models SELECT * FROM files WHERE filename = '{user_input}'

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.601965Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.392189Z digest=sha256:28f7da2c29c233de6dbb9238175b6e8ce3429ea4e11355019264533285e46e38

Observation 82a4395e-ee6c-400e-abc5-9b4384aaaa4a · outbound

This paper cites [...] Exam solutions:.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models [...] Exam solutions:

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.589448Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.395921Z digest=sha256:551f94dfc8c6dfcb6c4821531b3f91a2e9b5ff203ec5cde1f159ca04bc296813

Observation 11cc1283-7cfb-4e93-8e1d-69df6b4efe38 · outbound

This paper cites Security Group: {group['GroupName']}.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Security Group: {group['GroupName']}

Reference 41

Resolution
malformed identifier
raw_fallback, observed 2026-08-10T22:32:38.577661Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.399736Z digest=sha256:689e7338c0a559c29f8f3cf6ddfd3d6cea6540fe604a06cd70e5fa0817e93643

Pith citing papers

Observation 4354f13b-1192-43e7-8e2e-fb844b5a9a7d · inbound

Beyond Context: Large Language Models' Failure to Grasp Users' Intent cites this paper.

Beyond Context: Large Language Models' Failure to Grasp Users' Intent CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models

Reference 56

Resolution
metadata mismatch
arxiv_id, observed 2026-05-16T20:11:13.595981Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-16T20:09:25.827452Z digest=sha256:af910d6a3937da3ec9300bd4183c8fadfa15bf4538f7a5e7714c82a4939080fc

Observation cbc84e15-8cf5-4516-a13c-d0e9db908561 · inbound

A Validated Prompt Bank for Malicious Code Generation: Separating Executable Weapons from Security Knowledge in 1,554 Consensus-Labeled Prompts cites this paper.

A Validated Prompt Bank for Malicious Code Generation: Separating Executable Weapons from Security Knowledge in 1,554 Consensus-Labeled Prompts CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:45:39.774198Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-08T18:11:29.066362Z digest=sha256:17c52ed974e0a04a5d0d0509f6031bceaaa180f62b42fe7d5f455a693a2f30b1

Observation c77e2777-4729-4282-8dd3-d95762d319cd · inbound

Refusal Evaluation in Coding LLMs and Code Agents: A Systematic Review of Thirteen Malicious-Code Prompt Corpora (2023-2025) cites this paper.

Refusal Evaluation in Coding LLMs and Code Agents: A Systematic Review of Thirteen Malicious-Code Prompt Corpora (2023-2025) CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-21T07:39:48.600278Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-21T07:38:43.363709Z digest=sha256:881e94d8dca30249917e3e8aab5ae1b9d66cfd409f83cc060b4a4319414c1389

Observation c3e1333a-43e6-444d-b612-7a807749e5fa · inbound

Cybersecurity AI (CAI) Dataset cites this paper.

Cybersecurity AI (CAI) Dataset CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models

Reference 15

Resolution
verified exact
arxiv_id, observed 2026-06-29T12:13:26.859043Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-06-29T12:07:49.656453Z digest=sha256:4f2a3c6671e1bf563fa71b667a642906dc6149a5c03369ade76e76058ba52c52

Observation a5ccaa60-9c45-48f2-b43f-3e6cdae197b5 · inbound

Code as a Weapon: A Consensus-Labeled Prompt Bank for Measuring Coding-Model Compliance with Malicious-Code Requests cites this paper.

Code as a Weapon: A Consensus-Labeled Prompt Bank for Measuring Coding-Model Compliance with Malicious-Code Requests CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-06-29T11:33:22.642964Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-06-29T11:31:10.407386Z digest=sha256:35fbd8d4c51750e7d8eedf1b08936b9b7a118f5a1af5744c91694a9384d3d925