Pith. sign in

Paper Citation Record · LEDGER

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models

As of 14 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 5 inbound Pith citation observations for arXiv:2501.01335.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2501.01335 v1

Coverage vector

measured 41 of 41 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-10T22:32:38.399736Z

measured 46 of 46 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 5 of 5 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-06-29T12:07:49.656453Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-06-29T12:13:26.857749Z

Reference resolution

41 of 41 outbound references displayed

  • verified exact0
  • verified fuzzy26
  • unresolved14
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 394d2da9-20a5-4d2f-aba0-97f28a9487d0 · outbound

This paper cites Attention is all you need,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Attention is all you need,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.900094Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.240388Z digest=sha256:559772b43dc462f198af6f750a1c186bfd3150d7876209fd1b74bcd76d38d76f

Observation 85c47fea-b254-4483-94c5-8ed5bedf4865 · outbound

This paper cites BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.245105Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.245105Z digest=sha256:83187b82e12e26c7d099467c223a552cab3736396795ad20cfd3ab7153fdee4b

Observation 06334a4c-b326-40ff-b3a7-af985cfa448a · outbound

This paper cites GPT-4 Technical Report.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models GPT-4 Technical Report

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.249713Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.249713Z digest=sha256:5ab3bb623b7d6f377978e9d1cb236045e80b4fa77d7560b1bebd7ab71f69e053

Observation ee2b81a7-ce05-4e15-b14d-16675bc9ea02 · outbound

This paper cites Language models are few-shot learners,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Language models are few-shot learners,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.888463Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.254162Z digest=sha256:013a13baff939b96f3a0e3c8ba0a045af9b26f837fdd2e7d5c97e94d42af149a

Observation 3779f392-0e1d-423c-8d16-43f14af15ec2 · outbound

This paper cites Scaling Laws for Neural Language Models.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Scaling Laws for Neural Language Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.258417Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.258417Z digest=sha256:cc9dd65b9a3ef0d2539953de8be5fd5c95ee8dafc59b8eb3e01c7a9d6c891863

Observation bbf7f252-9a37-4b11-8356-e6d8a1eb7104 · outbound

This paper cites Emergent Abilities of Large Language Models.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Emergent Abilities of Large Language Models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.263658Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.263658Z digest=sha256:8cbebf23558d0bba9aa6dbe7f964297e28d5e1690e541aa3fbbae68943c05a3a

Observation e5e4b5da-e15a-43ae-a213-53a99deabc98 · outbound

This paper cites User centric evaluation of code generation tools (invited paper),.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models User centric evaluation of code generation tools (invited paper),

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.875961Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.268314Z digest=sha256:d063b0d93c9cc288b791ffa986d904431760a541dfdbe7c71b45849702fad171

Observation 1bfa694e-5319-4a42-a773-4fb2ed8ffbe3 · outbound

This paper cites Evaluating Large Language Models Trained on Code.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Evaluating Large Language Models Trained on Code

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.271863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.271863Z digest=sha256:54f9a9a3808f0cfc1cdd56f0698bbf80f29bb9ac7409747b6d60b9ed36e67128

Observation 5cf78ff7-23cd-4a91-a0be-68661a85cfaf · outbound

This paper cites GitHub and OpenAI Launch a New AI Tool That Generates Its Own Code,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models GitHub and OpenAI Launch a New AI Tool That Generates Its Own Code,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.863430Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.275886Z digest=sha256:da9381a0cb97d4385c2fb94f0f8caf334a734146dce51d332146ea1277ca4d01

Observation cfe53d0e-9895-4ba7-a6c3-9132f68cfcc7 · outbound

This paper cites Program Synthesis with Large Language Models.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Program Synthesis with Large Language Models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.283387Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.283387Z digest=sha256:6cb9c4a93768ad67c2655bba4a9504ac9196f2c105f5dfccc46a09d4b8547525

Observation fb596840-b193-4ff7-aded-cea867d10a39 · outbound

This paper cites Available: https://www.theverge.com/2021/6/29/22555777/ github-openai-ai-tool-autocomplete-code.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Available: https://www.theverge.com/2021/6/29/22555777/ github-openai-ai-tool-autocomplete-code

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.849828Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.279679Z digest=sha256:683693c644ba3b8852772bf3d43c8907edef6875acc4dc35769938e7032e163e

Observation 75b8d44c-00b9-44bb-8576-a849ba00d04b · outbound

This paper cites GitHub Copilot AI pair programmer: Asset or Liability?.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models GitHub Copilot AI pair programmer: Asset or Liability?

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.287350Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.287350Z digest=sha256:7c4320485dbd0dd5fb0ef591e3479f4a24699058c6dc4b3e16e6c12169fcc586

Observation 795f1630-e2ec-4742-9d0b-8716ca40b5e3 · outbound

This paper cites From ChatGPT to ThreatGPT: Impact of Generative AI in Cybersecurity and Privacy,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models From ChatGPT to ThreatGPT: Impact of Generative AI in Cybersecurity and Privacy,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.836778Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.291668Z digest=sha256:b9d2af1011c04dccbda0df09bebd9f0e7c8fb593c23a7942d349de47ba6b2c31

Observation c28cd4b5-51d0-401b-9765-e887f8799e09 · outbound

This paper cites (2023, April) Jailbreaking Large Language Models: A Comprehensive Guide.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models (2023, April) Jailbreaking Large Language Models: A Comprehensive Guide

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.824499Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.295400Z digest=sha256:7b968045aebf58a20bc281a2abe7f09cec67e6ccb09c750bd10fb05092c2d5eb

Observation 23059078-f6ee-4f6e-9942-36d70484c918 · outbound

This paper cites Low-Resource Languages Jailbreak GPT-4,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Low-Resource Languages Jailbreak GPT-4,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.811814Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.299129Z digest=sha256:367e73aff3eb1c26691175b9faf9b0a2cd562c96c17c359cba7b6b92c0db98a4

Observation 369f7a32-70d8-4ae1-bfd3-4521cd26ad8c · outbound

This paper cites Making Them Ask and Answer: Jail- breaking Large Language Models in Few Queries via Disguise and Reconstruction,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Making Them Ask and Answer: Jail- breaking Large Language Models in Few Queries via Disguise and Reconstruction,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.800544Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.302654Z digest=sha256:b676deab24d7dad4817329de2a9cf428e34d2c4fc4726ed35dc4667bc4646582

Observation 47bb46b7-dc36-4e93-8da6-5b7728b6eb8f · outbound

This paper cites A Wolf in Sheep's Clothing: Generalized Nested Jailbreak Prompts can Fool Large Language Models Easily.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models A Wolf in Sheep's Clothing: Generalized Nested Jailbreak Prompts can Fool Large Language Models Easily

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.306228Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.306228Z digest=sha256:94372564b4b232cc210e057317213ef1adf9258b381f794f7c72f534611aade9

Observation b65b8c4f-3271-444d-9564-7978ac20a2cb · outbound

This paper cites ArtPrompt: ASCII Art-based Jailbreak Attacks against Aligned LLMs.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models ArtPrompt: ASCII Art-based Jailbreak Attacks against Aligned LLMs

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.310299Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.310299Z digest=sha256:059a09e50004d8a6d6fc8350ee39ae560604518b15405b6c7921772ac94c50c9

Observation a5f85662-b51c-4054-81a3-66a3acd0e78d · outbound

This paper cites WordGame: Efficient & Effective LLM Jailbreak via Simultaneous Obfuscation in Query and Response.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models WordGame: Efficient & Effective LLM Jailbreak via Simultaneous Obfuscation in Query and Response

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.314160Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.314160Z digest=sha256:bde3e276e8c2817fe34ef8a256338e2b8fd5a897bcf9b318127de265c548533b

Observation 04f18928-7900-42da-8b72-6a48dea64be2 · outbound

This paper cites Jailbreaking Black Box Large Language Models in Twenty Queries.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Jailbreaking Black Box Large Language Models in Twenty Queries

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.318160Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.318160Z digest=sha256:350c52852543ea3879063f2c00ede203358cdcf9b257c239d7bb4df621097a41

Observation aa658a1a-add4-4a07-b7cd-cdb01994be11 · outbound

This paper cites AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.322495Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.322495Z digest=sha256:f6b126d8eac969b0179d4482882d63886651b9d69209b8ba6090b882b43b960d

Observation 4585807e-2935-490f-8662-0a092b346e74 · outbound

This paper cites Universal and transferable adversarial attacks on aligned language models,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Universal and transferable adversarial attacks on aligned language models,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.326659Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.326659Z digest=sha256:582b3203709bbed7b1cd7f0f2db8a1ab9f780ed3fe035870bb4287f152bd969f

Observation b8610f2e-47ae-4cae-8659-e84485a13a41 · outbound

This paper cites HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.781864Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.330339Z digest=sha256:ebb8434460ef79a10921c7c92c9a20f6102a16c248827c2975a7aa324978efc3

Observation 91792451-f15e-4212-ac6d-e8062af6ab99 · outbound

This paper cites Malicious tasks dataset,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Malicious tasks dataset,

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.770146Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.334159Z digest=sha256:47aa12cad04d724aa0e007d6022b551cbd3f76fa994ff4cfccd3a4410992dfdd

Observation 6f52abfc-b334-472d-8168-4543b6507443 · outbound

This paper cites ‘Do Anything Now’: Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models ‘Do Anything Now’: Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.759626Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.338012Z digest=sha256:c80c58d22c049d222a72eced640807f80474392a7b7b820c11204048da7c6480

Observation c52494ba-cdcc-41c4-99f2-b71fbdefc1c4 · outbound

This paper cites Jailbreakv28k,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Jailbreakv28k,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.747605Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.341879Z digest=sha256:7bf58029b04b2fd43f01a6ee7f34ac29cf302a3757891e8f8d46461e3c5a337a

Observation 13453a22-50cd-4e52-a56f-ae30aa701761 · outbound

This paper cites Chatgpt-jailbreak-prompts,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Chatgpt-jailbreak-prompts,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.736401Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.345808Z digest=sha256:e39982bdb11d9146c46050983a7631d1e98d87e94da8af031f30b6f8e1a08b9c

Observation bce99a5c-7eec-418d-9cd5-9c62ba89b05f · outbound

This paper cites Jailbreakhub,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Jailbreakhub,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.724915Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.349600Z digest=sha256:12651ad2768175b417d8cc6e8d6b5c96a21d20807b8fc61cf8d0aa0d54e68c14

Observation 75f2139a-ca16-4e1b-bccb-602ee3084b70 · outbound

This paper cites Malicious-llm-prompts-v4,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Malicious-llm-prompts-v4,

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.712709Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.353695Z digest=sha256:e68edfc97068f347423b68ee076b32609c812b685a8e18fea9832997d0f0dfd9

Observation 813ca809-fb8f-48d0-86d3-dc8786ddeae8 · outbound

This paper cites Prompt injection,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Prompt injection,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.701517Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.357477Z digest=sha256:4ae1ee368760feea0cb4234007bc39a7fa9e0f0d2bb11fe076effddf82b99e10

Observation edf76cb9-b1cc-48ca-b7c7-8219466ebb49 · outbound

This paper cites Wahr ´eus, A.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Wahr ´eus, A

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.689917Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.361367Z digest=sha256:638e675b5684cd4eb3f0c9cd46789c0ef9ff73ab7421a75f0fa05ac28bb05030

Observation b37494c0-383a-4279-9e11-7b440e425828 · outbound

This paper cites (2024) Homepage.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models (2024) Homepage

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.678044Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.365081Z digest=sha256:5e3da56917f6b5a6e90ec3c280e8ec1d6cceb8bfe26d19c88d4b1852fbd6379c

Observation c2a3fb33-a72e-4548-bf02-df0a8b24220f · outbound

This paper cites Gemini: Google’s generative ai platform,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Gemini: Google’s generative ai platform,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.665469Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.369093Z digest=sha256:067914c3a50535260371068d4e895516a8e5329d7a93de558e6eda93dfe41e19

Observation f71cae31-1adb-4a68-be46-80463d21cf69 · outbound

This paper cites Claude: Anthropic’s AI Assistant,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Claude: Anthropic’s AI Assistant,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.651951Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.372809Z digest=sha256:095ad3cd0ce6a4297a6975eefc48d45aaa38fc0b4eb05de0e66c87af27bbab77

Observation eda6621f-06da-498b-82a2-9325344c28ff · outbound

This paper cites GPT-4o Mini: Advancing Cost-Efficient Intelligence,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models GPT-4o Mini: Advancing Cost-Efficient Intelligence,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.639613Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.376584Z digest=sha256:44983055adcb5cc8f438d263dabf8e9c2706f460b59a0c52252f94be27d99cd1

Observation fbeefd07-2889-4061-bd1a-4e0e912bf30d · outbound

This paper cites (2024) MECE Principle: Definition, Exam- ples, and Tips.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models (2024) MECE Principle: Definition, Exam- ples, and Tips

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.626742Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.380302Z digest=sha256:4ca7af51a31c32a95cd73bdb17f88502657947d83c2200759eca4623162e93f0

Observation 7fd6d0aa-b977-4c09-a1f2-20e64604fe23 · outbound

This paper cites Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:38.384119Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:38.384119Z digest=sha256:70e3cb083eb901da17c4f0ab939947d13470bd63f07e222875958f3794e6d853

Observation 9574c9bd-f1c5-4e4c-883d-875c7300ae1d · outbound

This paper cites Leaderboards: Models,.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Leaderboards: Models,

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.614072Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.388355Z digest=sha256:cdbec8e767bb1ad089a5fdb6e547f22c5b5a962ca9119cc162dd63111ba66966

Observation 9a4a2d54-4430-4c47-9ea6-615404516cc7 · outbound

This paper cites SELECT * FROM files WHERE filename = '{user_input}'.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models SELECT * FROM files WHERE filename = '{user_input}'

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.601965Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.392189Z digest=sha256:62f06e088a609d1170430591199e6096eabe72be5f8c2a67b9c1d4d3b779531c

Observation 82a4395e-ee6c-400e-abc5-9b4384aaaa4a · outbound

This paper cites [...] Exam solutions:.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models [...] Exam solutions:

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-10T22:32:38.589448Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.395921Z digest=sha256:5e8ccb822c5165856a042bdc2073e792a42599f92eaaa42cf3dcc6e4482386ae

Observation 11cc1283-7cfb-4e93-8e1d-69df6b4efe38 · outbound

This paper cites Security Group: {group['GroupName']}.

CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models Security Group: {group['GroupName']}

Reference 41

Resolution
malformed identifier
raw_fallback, observed 2026-08-10T22:32:38.577661Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-08-10T22:32:38.399736Z digest=sha256:b574a63f21f51141cb2ee48d1975f345e05a77c4278560b4f341b30805d865d3

Pith citing papers

Observation 4354f13b-1192-43e7-8e2e-fb844b5a9a7d · inbound

Beyond Context: Large Language Models' Failure to Grasp Users' Intent cites this paper.

Beyond Context: Large Language Models' Failure to Grasp Users' Intent CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models

Reference 56

Resolution
metadata mismatch
arxiv_id, observed 2026-05-16T20:11:13.595981Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-16T20:09:25.827452Z digest=sha256:d74ae5897a181a3bcec049dcc8237b856e1ab7ba7b15c579b033740ba4855023

Observation cbc84e15-8cf5-4516-a13c-d0e9db908561 · inbound

A Validated Prompt Bank for Malicious Code Generation: Separating Executable Weapons from Security Knowledge in 1,554 Consensus-Labeled Prompts cites this paper.

A Validated Prompt Bank for Malicious Code Generation: Separating Executable Weapons from Security Knowledge in 1,554 Consensus-Labeled Prompts CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:45:39.774198Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-08T18:11:29.066362Z digest=sha256:4c51e1f96f2e09a46fdb765d160bb137c0b2ac163dec5accd6ca864ce3a6d43a

Observation c77e2777-4729-4282-8dd3-d95762d319cd · inbound

Refusal Evaluation in Coding LLMs and Code Agents: A Systematic Review of Thirteen Malicious-Code Prompt Corpora (2023-2025) cites this paper.

Refusal Evaluation in Coding LLMs and Code Agents: A Systematic Review of Thirteen Malicious-Code Prompt Corpora (2023-2025) CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-21T07:39:48.600278Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-21T07:38:43.363709Z digest=sha256:0e0ca78071cedd7e3f2ad9625754effb6e00788a44f44d70e6bb46c041ccebbd

Observation c3e1333a-43e6-444d-b612-7a807749e5fa · inbound

Cybersecurity AI (CAI) Dataset cites this paper.

Cybersecurity AI (CAI) Dataset CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models

Reference 15

Resolution
verified exact
arxiv_id, observed 2026-06-29T12:13:26.859043Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-06-29T12:07:49.656453Z digest=sha256:ff1eb75dd771874c6e0d433fbeba99dd373b88ca89a27ce30c6a01532d7a0d5a

Observation a5ccaa60-9c45-48f2-b43f-3e6cdae197b5 · inbound

Code as a Weapon: A Consensus-Labeled Prompt Bank for Measuring Coding-Model Compliance with Malicious-Code Requests cites this paper.

Code as a Weapon: A Consensus-Labeled Prompt Bank for Measuring Coding-Model Compliance with Malicious-Code Requests CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-06-29T11:33:22.642964Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-06-29T11:31:10.407386Z digest=sha256:e0c7f0a83661f715b10ce7b5eaf7c7b4971906cda2da91fbf8b4c249f1416fa4