{"as_of":"2026-08-14T13:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b103ea47ed0b501915dac81a4fa0e7f85a4e96f7f6307f44e5fedfcd3102b641","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:32:38.399736Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T12:07:49.656453Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T12:13:26.857749Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"cited_work":{"arxiv_id":"2501.01335","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01335","snapshot_observed_at":"2026-06-29T12:13:26.857749Z","title":"CySecBench: Generative AI-based cybersecurity-focused prompt dataset for benchmarking large language models","venue":null,"work_id":"25f6429c-1ba1-4fe4-847d-8119e1efe787","year":2024},"citing_paper":{"arxiv_id":"2512.21110","last_updated":"2026-04-24T20:27:34Z","snapshot_observed_at":"2026-08-13T01:23:04.938311Z","submitted_at":"2025-12-24T11:15:57Z","title":"Beyond Context: Large Language Models' Failure to Grasp Users' Intent","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-16T20:09:25.827452Z"},"links":{"cited_paper":"/paper/2501.01335","citing_paper":"/paper/2512.21110"},"observation_digest":"sha256:d74ae5897a181a3bcec049dcc8237b856e1ab7ba7b15c579b033740ba4855023","observation_id":"4354f13b-1192-43e7-8e2e-fb844b5a9a7d","resolution":{"observed_at":"2026-05-16T20:11:13.595981Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"cited_work":{"arxiv_id":"2501.01335","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01335","snapshot_observed_at":"2026-06-29T12:13:26.857749Z","title":"CySecBench: Generative AI-based cybersecurity-focused prompt dataset for benchmarking large language models","venue":null,"work_id":"25f6429c-1ba1-4fe4-847d-8119e1efe787","year":2024},"citing_paper":{"arxiv_id":"2605.03179","last_updated":"2026-05-04T21:42:10Z","snapshot_observed_at":"2026-08-05T14:29:07.431614Z","submitted_at":"2026-05-04T21:42:10Z","title":"A Validated Prompt Bank for Malicious Code Generation: Separating Executable Weapons from Security Knowledge in 1,554 Consensus-Labeled Prompts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T18:11:29.066362Z"},"links":{"cited_paper":"/paper/2501.01335","citing_paper":"/paper/2605.03179"},"observation_digest":"sha256:4c51e1f96f2e09a46fdb765d160bb137c0b2ac163dec5accd6ca864ce3a6d43a","observation_id":"cbc84e15-8cf5-4516-a13c-d0e9db908561","resolution":{"observed_at":"2026-05-09T06:45:39.774198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"cited_work":{"arxiv_id":"2501.01335","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01335","snapshot_observed_at":"2026-06-29T12:13:26.857749Z","title":"CySecBench: Generative AI-based cybersecurity-focused prompt dataset for benchmarking large language models","venue":null,"work_id":"25f6429c-1ba1-4fe4-847d-8119e1efe787","year":2024},"citing_paper":{"arxiv_id":"2605.20351","last_updated":"2026-05-19T18:05:51Z","snapshot_observed_at":"2026-08-12T15:57:36.816936Z","submitted_at":"2026-05-19T18:05:51Z","title":"Refusal Evaluation in Coding LLMs and Code Agents: A Systematic Review of Thirteen Malicious-Code Prompt Corpora (2023-2025)","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T07:38:43.363709Z"},"links":{"cited_paper":"/paper/2501.01335","citing_paper":"/paper/2605.20351"},"observation_digest":"sha256:0e0ca78071cedd7e3f2ad9625754effb6e00788a44f44d70e6bb46c041ccebbd","observation_id":"c77e2777-4729-4282-8dd3-d95762d319cd","resolution":{"observed_at":"2026-05-21T07:39:48.600278Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"cited_work":{"arxiv_id":"2501.01335","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01335","snapshot_observed_at":"2026-06-29T12:13:26.857749Z","title":"CySecBench: Generative AI-based cybersecurity-focused prompt dataset for benchmarking large language models","venue":null,"work_id":"25f6429c-1ba1-4fe4-847d-8119e1efe787","year":2024},"citing_paper":{"arxiv_id":"2605.28146","last_updated":"2026-05-27T08:29:28Z","snapshot_observed_at":"2026-08-04T10:57:53.122170Z","submitted_at":"2026-05-27T08:29:28Z","title":"Cybersecurity AI (CAI) Dataset","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T12:07:49.656453Z"},"links":{"cited_paper":"/paper/2501.01335","citing_paper":"/paper/2605.28146"},"observation_digest":"sha256:ff1eb75dd771874c6e0d433fbeba99dd373b88ca89a27ce30c6a01532d7a0d5a","observation_id":"c3e1333a-43e6-444d-b612-7a807749e5fa","resolution":{"observed_at":"2026-06-29T12:13:26.859043Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"cited_work":{"arxiv_id":"2501.01335","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.01335","snapshot_observed_at":"2026-06-29T12:13:26.857749Z","title":"CySecBench: Generative AI-based cybersecurity-focused prompt dataset for benchmarking large language models","venue":null,"work_id":"25f6429c-1ba1-4fe4-847d-8119e1efe787","year":2024},"citing_paper":{"arxiv_id":"2605.28734","last_updated":"2026-05-27T16:55:15Z","snapshot_observed_at":"2026-08-14T03:42:37.388581Z","submitted_at":"2026-05-27T16:55:15Z","title":"Code as a Weapon: A Consensus-Labeled Prompt Bank for Measuring Coding-Model Compliance with Malicious-Code Requests","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T11:31:10.407386Z"},"links":{"cited_paper":"/paper/2501.01335","citing_paper":"/paper/2605.28734"},"observation_digest":"sha256:e0c7f0a83661f715b10ce7b5eaf7c7b4971906cda2da91fbf8b4c249f1416fa4","observation_id":"a5ccaa60-9c45-48f2-b43f-3e6cdae197b5","resolution":{"observed_at":"2026-06-29T11:33:22.642964Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.01335/citation-record","integrity":"/paper/2501.01335/integrity","json":"/paper/2501.01335/citation-record.json","paper":"/paper/2501.01335"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.896069Z","title":"Attention is all you need,","venue":null,"work_id":"61f4225e-d3ac-4c1a-9401-3b23fcf92063","year":2017},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.240388Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:559772b43dc462f198af6f750a1c186bfd3150d7876209fd1b74bcd76d38d76f","observation_id":"394d2da9-20a5-4d2f-aba0-97f28a9487d0","resolution":{"observed_at":"2026-08-10T22:32:38.900094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-10T22:32:38.245105Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.245105Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:83187b82e12e26c7d099467c223a552cab3736396795ad20cfd3ab7153fdee4b","observation_id":"85c47fea-b254-4483-94c5-8ed5bedf4865","resolution":{"observed_at":"2026-08-10T22:32:38.245105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T22:32:38.249713Z","title":"GPT-4 Technical Report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.249713Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:5ab3bb623b7d6f377978e9d1cb236045e80b4fa77d7560b1bebd7ab71f69e053","observation_id":"06334a4c-b326-40ff-b3a7-af985cfa448a","resolution":{"observed_at":"2026-08-10T22:32:38.249713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.883453Z","title":"Language models are few-shot learners,","venue":null,"work_id":"512b3a38-a896-494f-a0e3-11ce8a367f76","year":2020},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.254162Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:013a13baff939b96f3a0e3c8ba0a045af9b26f837fdd2e7d5c97e94d42af149a","observation_id":"ee2b81a7-ce05-4e15-b14d-16675bc9ea02","resolution":{"observed_at":"2026-08-10T22:32:38.888463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-10T22:32:38.258417Z","title":"Scaling laws for neural language models,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.258417Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:cc9dd65b9a3ef0d2539953de8be5fd5c95ee8dafc59b8eb3e01c7a9d6c891863","observation_id":"3779f392-0e1d-423c-8d16-43f14af15ec2","resolution":{"observed_at":"2026-08-10T22:32:38.258417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-10T22:32:38.263658Z","title":"Emergent abilities of large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.263658Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:8cbebf23558d0bba9aa6dbe7f964297e28d5e1690e541aa3fbbae68943c05a3a","observation_id":"bbf7f252-9a37-4b11-8356-e6d8a1eb7104","resolution":{"observed_at":"2026-08-10T22:32:38.263658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.871574Z","title":"User centric evaluation of code generation tools (invited paper),","venue":null,"work_id":"4e5e0f60-74db-4012-887e-298e4faa1203","year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.268314Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:d063b0d93c9cc288b791ffa986d904431760a541dfdbe7c71b45849702fad171","observation_id":"e5e4b5da-e15a-43ae-a213-53a99deabc98","resolution":{"observed_at":"2026-08-10T22:32:38.875961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-10T22:32:38.271863Z","title":"Evaluating Large Language Models Trained on Code,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.271863Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:54f9a9a3808f0cfc1cdd56f0698bbf80f29bb9ac7409747b6d60b9ed36e67128","observation_id":"1bfa694e-5319-4a42-a773-4fb2ed8ffbe3","resolution":{"observed_at":"2026-08-10T22:32:38.271863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.858310Z","title":"GitHub and OpenAI Launch a New AI Tool That Generates Its Own Code,","venue":null,"work_id":"fbe6ac1d-a2fd-4092-8cd1-40f08cb9dded","year":2021},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.275886Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:da9381a0cb97d4385c2fb94f0f8caf334a734146dce51d332146ea1277ca4d01","observation_id":"5cf78ff7-23cd-4a91-a0be-68661a85cfaf","resolution":{"observed_at":"2026-08-10T22:32:38.863430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-10T22:32:38.283387Z","title":"Program Synthesis with Large Language Models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.283387Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:6cb9c4a93768ad67c2655bba4a9504ac9196f2c105f5dfccc46a09d4b8547525","observation_id":"cfe53d0e-9895-4ba7-a6c3-9132f68cfcc7","resolution":{"observed_at":"2026-08-10T22:32:38.283387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.845457Z","title":"Available: https://www.theverge.com/2021/6/29/22555777/ github-openai-ai-tool-autocomplete-code","venue":null,"work_id":"b054549c-8c83-40da-9ad9-e6bcb0110873","year":2021},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.279679Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:683693c644ba3b8852772bf3d43c8907edef6875acc4dc35769938e7032e163e","observation_id":"fb596840-b193-4ff7-aded-cea867d10a39","resolution":{"observed_at":"2026-08-10T22:32:38.849828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.15331","last_updated":"2023-04-14T20:52:00Z","snapshot_observed_at":"2026-08-13T15:13:32.201384Z","submitted_at":"2022-06-30T15:00:03Z","title":"GitHub Copilot AI pair programmer: Asset or Liability?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.15331","snapshot_observed_at":"2026-08-10T22:32:38.287350Z","title":"GitHub Copilot AI pair programmer: Asset or Liability?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.287350Z"},"links":{"cited_paper":"/paper/2206.15331","citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:7c4320485dbd0dd5fb0ef591e3479f4a24699058c6dc4b3e16e6c12169fcc586","observation_id":"75b8d44c-00b9-44bb-8576-a849ba00d04b","resolution":{"observed_at":"2026-08-10T22:32:38.287350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.832574Z","title":"From ChatGPT to ThreatGPT: Impact of Generative AI in Cybersecurity and Privacy,","venue":null,"work_id":"89b34a24-da8f-4fbf-9c90-3e54e14d0cbd","year":2023},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.291668Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:b9d2af1011c04dccbda0df09bebd9f0e7c8fb593c23a7942d349de47ba6b2c31","observation_id":"795f1630-e2ec-4742-9d0b-8716ca40b5e3","resolution":{"observed_at":"2026-08-10T22:32:38.836778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.819516Z","title":"(2023, April) Jailbreaking Large Language Models: A Comprehensive Guide","venue":null,"work_id":"f613316f-663e-4500-ad78-cb41156baa33","year":2023},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.295400Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:7b968045aebf58a20bc281a2abe7f09cec67e6ccb09c750bd10fb05092c2d5eb","observation_id":"c28cd4b5-51d0-401b-9765-e887f8799e09","resolution":{"observed_at":"2026-08-10T22:32:38.824499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.808050Z","title":"Low-Resource Languages Jailbreak GPT-4,","venue":null,"work_id":"a1bc6c3f-4ad7-4e48-b9a5-c34a6302791c","year":2023},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.299129Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:367e73aff3eb1c26691175b9faf9b0a2cd562c96c17c359cba7b6b92c0db98a4","observation_id":"23059078-f6ee-4f6e-9942-36d70484c918","resolution":{"observed_at":"2026-08-10T22:32:38.811814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.796565Z","title":"Making Them Ask and Answer: Jail- breaking Large Language Models in Few Queries via Disguise and Reconstruction,","venue":null,"work_id":"3cd4487a-0f05-4c96-9fa2-698ef6deef0d","year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.302654Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:b676deab24d7dad4817329de2a9cf428e34d2c4fc4726ed35dc4667bc4646582","observation_id":"369f7a32-70d8-4ae1-bfd3-4521cd26ad8c","resolution":{"observed_at":"2026-08-10T22:32:38.800544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08268","last_updated":"2024-04-07T03:04:10Z","snapshot_observed_at":"2026-08-13T05:25:30.661845Z","submitted_at":"2023-11-14T16:02:16Z","title":"A Wolf in Sheep's Clothing: Generalized Nested Jailbreak Prompts can Fool Large Language Models Easily","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08268","snapshot_observed_at":"2026-08-10T22:32:38.306228Z","title":"A wolf in sheep’s clothing: Generalized nested jailbreak prompts can fool large language models easily,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.306228Z"},"links":{"cited_paper":"/paper/2311.08268","citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:94372564b4b232cc210e057317213ef1adf9258b381f794f7c72f534611aade9","observation_id":"47bb46b7-dc36-4e93-8da6-5b7728b6eb8f","resolution":{"observed_at":"2026-08-10T22:32:38.306228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11753","last_updated":"2024-06-07T17:35:17Z","snapshot_observed_at":"2026-08-13T04:15:51.457198Z","submitted_at":"2024-02-19T00:43:31Z","title":"ArtPrompt: ASCII Art-based Jailbreak Attacks against Aligned LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11753","snapshot_observed_at":"2026-08-10T22:32:38.310299Z","title":"ArtPrompt: ASCII Art-based Jailbreak Attacks against Aligned LLMs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.310299Z"},"links":{"cited_paper":"/paper/2402.11753","citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:059a09e50004d8a6d6fc8350ee39ae560604518b15405b6c7921772ac94c50c9","observation_id":"b65b8c4f-3271-444d-9564-7978ac20a2cb","resolution":{"observed_at":"2026-08-10T22:32:38.310299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14023","last_updated":"2024-05-22T21:59:22Z","snapshot_observed_at":"2026-08-13T00:01:47.549602Z","submitted_at":"2024-05-22T21:59:22Z","title":"WordGame: Efficient & Effective LLM Jailbreak via Simultaneous Obfuscation in Query and Response","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14023","snapshot_observed_at":"2026-08-10T22:32:38.314160Z","title":"WordGame: Efficient & Effective LLM Jailbreak via Simultaneous Obfuscation in Query and Response,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.314160Z"},"links":{"cited_paper":"/paper/2405.14023","citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:bde3e276e8c2817fe34ef8a256338e2b8fd5a897bcf9b318127de265c548533b","observation_id":"a5f85662-b51c-4054-81a3-66a3acd0e78d","resolution":{"observed_at":"2026-08-10T22:32:38.314160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-12T12:29:45.113982Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-10T22:32:38.318160Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.318160Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:350c52852543ea3879063f2c00ede203358cdcf9b257c239d7bb4df621097a41","observation_id":"04f18928-7900-42da-8b72-6a48dea64be2","resolution":{"observed_at":"2026-08-10T22:32:38.318160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-10T22:32:38.322495Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.322495Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:f6b126d8eac969b0179d4482882d63886651b9d69209b8ba6090b882b43b960d","observation_id":"aa658a1a-add4-4a07-b7cd-cdb01994be11","resolution":{"observed_at":"2026-08-10T22:32:38.322495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.326659Z","title":"Universal and transferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.326659Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:582b3203709bbed7b1cd7f0f2db8a1ab9f780ed3fe035870bb4287f152bd969f","observation_id":"4585807e-2935-490f-8662-0a092b346e74","resolution":{"observed_at":"2026-08-10T22:32:38.326659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.777608Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal,","venue":null,"work_id":"127b0c66-da04-4199-ab0b-dd8fab84c940","year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.330339Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:ebb8434460ef79a10921c7c92c9a20f6102a16c248827c2975a7aa324978efc3","observation_id":"b8610f2e-47ae-4cae-8659-e84485a13a41","resolution":{"observed_at":"2026-08-10T22:32:38.781864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.766638Z","title":"Malicious tasks dataset,","venue":null,"work_id":"964d6ae1-0197-493d-8309-bc47af87ed16","year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.334159Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:47aa12cad04d724aa0e007d6022b551cbd3f76fa994ff4cfccd3a4410992dfdd","observation_id":"91792451-f15e-4212-ac6d-e8062af6ab99","resolution":{"observed_at":"2026-08-10T22:32:38.770146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.755678Z","title":"‘Do Anything Now’: Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models,","venue":null,"work_id":"7cc65dd3-6345-4621-9b58-423d1d8c7b23","year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.338012Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:c80c58d22c049d222a72eced640807f80474392a7b7b820c11204048da7c6480","observation_id":"6f52abfc-b334-472d-8168-4543b6507443","resolution":{"observed_at":"2026-08-10T22:32:38.759626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.743767Z","title":"Jailbreakv28k,","venue":null,"work_id":"8c1e311a-6937-413b-9730-64ce30278117","year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.341879Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:7bf58029b04b2fd43f01a6ee7f34ac29cf302a3757891e8f8d46461e3c5a337a","observation_id":"c52494ba-cdcc-41c4-99f2-b71fbdefc1c4","resolution":{"observed_at":"2026-08-10T22:32:38.747605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.732526Z","title":"Chatgpt-jailbreak-prompts,","venue":null,"work_id":"3855a6bf-c608-4c61-a53f-665d9c1ee321","year":2023},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.345808Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:e39982bdb11d9146c46050983a7631d1e98d87e94da8af031f30b6f8e1a08b9c","observation_id":"13453a22-50cd-4e52-a56f-ae30aa701761","resolution":{"observed_at":"2026-08-10T22:32:38.736401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.720084Z","title":"Jailbreakhub,","venue":null,"work_id":"c10c2fd5-aa5e-4370-a0cf-8d006ab4c857","year":2023},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.349600Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:12651ad2768175b417d8cc6e8d6b5c96a21d20807b8fc61cf8d0aa0d54e68c14","observation_id":"bce99a5c-7eec-418d-9cd5-9c62ba89b05f","resolution":{"observed_at":"2026-08-10T22:32:38.724915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.708899Z","title":"Malicious-llm-prompts-v4,","venue":null,"work_id":"f99d799a-ad34-432a-a5da-e97e5430b9a3","year":2023},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.353695Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:e68edfc97068f347423b68ee076b32609c812b685a8e18fea9832997d0f0dfd9","observation_id":"75f2139a-ca16-4e1b-bccb-602ee3084b70","resolution":{"observed_at":"2026-08-10T22:32:38.712709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.697766Z","title":"Prompt injection,","venue":null,"work_id":"55dc99ce-cb0f-4611-b3e1-7d173f101670","year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.357477Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:4ae1ee368760feea0cb4234007bc39a7fa9e0f0d2bb11fe076effddf82b99e10","observation_id":"813ca809-fb8f-48d0-86d3-dc8786ddeae8","resolution":{"observed_at":"2026-08-10T22:32:38.701517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.685747Z","title":"Wahr ´eus, A","venue":null,"work_id":"a6c5632e-8f5a-420e-ad79-0b8fbcaca361","year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.361367Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:638e675b5684cd4eb3f0c9cd46789c0ef9ff73ab7421a75f0fa05ac28bb05030","observation_id":"edf76cb9-b1cc-48ca-b7c7-8219466ebb49","resolution":{"observed_at":"2026-08-10T22:32:38.689917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.673167Z","title":"(2024) Homepage","venue":null,"work_id":"4c4b0cf2-e147-4976-829d-bd2f9a1c9373","year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.365081Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:5e3da56917f6b5a6e90ec3c280e8ec1d6cceb8bfe26d19c88d4b1852fbd6379c","observation_id":"b37494c0-383a-4279-9e11-7b440e425828","resolution":{"observed_at":"2026-08-10T22:32:38.678044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.660489Z","title":"Gemini: Google’s generative ai platform,","venue":null,"work_id":"2dc19314-33da-4af7-a63b-d33b07c30b3e","year":2023},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.369093Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:067914c3a50535260371068d4e895516a8e5329d7a93de558e6eda93dfe41e19","observation_id":"c2a3fb33-a72e-4548-bf02-df0a8b24220f","resolution":{"observed_at":"2026-08-10T22:32:38.665469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.647901Z","title":"Claude: Anthropic’s AI Assistant,","venue":null,"work_id":"5ca5a711-52b5-44a1-a5d3-df119653d53f","year":2023},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.372809Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:095ad3cd0ce6a4297a6975eefc48d45aaa38fc0b4eb05de0e66c87af27bbab77","observation_id":"f71cae31-1adb-4a68-be46-80463d21cf69","resolution":{"observed_at":"2026-08-10T22:32:38.651951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.635367Z","title":"GPT-4o Mini: Advancing Cost-Efficient Intelligence,","venue":null,"work_id":"7fd8304b-4bc4-4e84-9582-c756ef3c5d79","year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.376584Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:44983055adcb5cc8f438d263dabf8e9c2706f460b59a0c52252f94be27d99cd1","observation_id":"eda6621f-06da-498b-82a2-9325344c28ff","resolution":{"observed_at":"2026-08-10T22:32:38.639613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.622352Z","title":"(2024) MECE Principle: Definition, Exam- ples, and Tips","venue":null,"work_id":"439bacfd-cde6-4694-ab35-05d4f39755b3","year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.380302Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:4ca7af51a31c32a95cd73bdb17f88502657947d83c2200759eca4623162e93f0","observation_id":"fbeefd07-2889-4061-bd1a-4e0e912bf30d","resolution":{"observed_at":"2026-08-10T22:32:38.626742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-10T22:32:38.384119Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.384119Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:70e3cb083eb901da17c4f0ab939947d13470bd63f07e222875958f3794e6d853","observation_id":"7fd6d0aa-b977-4c09-a1f2-20e64604fe23","resolution":{"observed_at":"2026-08-10T22:32:38.384119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.609960Z","title":"Leaderboards: Models,","venue":null,"work_id":"4af348cb-c4eb-480b-92d7-432d289cae7e","year":2024},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.388355Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:cdbec8e767bb1ad089a5fdb6e547f22c5b5a962ca9119cc162dd63111ba66966","observation_id":"9574c9bd-f1c5-4e4c-883d-875c7300ae1d","resolution":{"observed_at":"2026-08-10T22:32:38.614072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.597896Z","title":"SELECT * FROM files WHERE filename = '{user_input}'","venue":null,"work_id":"23f99ff0-a7ca-4545-aa14-d2c2b0863f8b","year":null},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.392189Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:62f06e088a609d1170430591199e6096eabe72be5f8c2a67b9c1d4d3b779531c","observation_id":"9a4a2d54-4430-4c47-9ea6-615404516cc7","resolution":{"observed_at":"2026-08-10T22:32:38.601965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.585572Z","title":"[...] Exam solutions:","venue":null,"work_id":"55079a5f-437f-4e15-963a-c7f28fbb5dbe","year":null},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.395921Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:5e8ccb822c5165856a042bdc2073e792a42599f92eaaa42cf3dcc6e4482386ae","observation_id":"82a4395e-ee6c-400e-abc5-9b4384aaaa4a","resolution":{"observed_at":"2026-08-10T22:32:38.589448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T22:32:38.571784Z","title":"Security Group: {group['GroupName']}","venue":null,"work_id":"42f49af2-7161-43f8-8fff-4734c7f4c6ea","year":null},"citing_paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:38.399736Z"},"links":{"citing_paper":"/paper/2501.01335"},"observation_digest":"sha256:b574a63f21f51141cb2ee48d1975f345e05a77c4278560b4f341b30805d865d3","observation_id":"11cc1283-7cfb-4e93-8e1d-69df6b4efe38","resolution":{"observed_at":"2026-08-10T22:32:38.577661Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.01335","last_updated":"2025-01-02T16:37:04Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-14T09:12:12.122761Z","submitted_at":"2025-01-02T16:37:04Z","title":"CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 5 inbound Pith citation observations for arXiv:2501.01335."}