{"as_of":"2026-08-17T16:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:44a2069b71235b8e6c82703971db2177c2db9930392201bc29d685b4f4e26b10","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:59:21.169998Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09567/citation-record","integrity":"/paper/2608.09567/integrity","json":"/paper/2608.09567/citation-record.json","paper":"/paper/2608.09567"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.737748Z","title":"Repeatability in computer systems research.Com- munications of the ACM, 59(3):62–69, 2016","venue":null,"work_id":"f028eafc-38ba-4069-a303-6037ea8cef91","year":2016},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.105922Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:4535f167acbd8288604cb20dceb152c52c77e38e9164ea406d26ada918bf822f","observation_id":"a1282627-8509-4760-946d-533861cd7381","resolution":{"observed_at":"2026-08-11T14:59:21.741603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.727756Z","title":"PentestGPT: Evaluating and harnessing large lan- guage models for automated penetration testing","venue":null,"work_id":"65647564-71e0-4499-bafd-9f7e4c1e8a9b","year":2024},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.109554Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:c0aa4bcc634d2a63d0f89bf5371fcc5a38bd460b3fd6a743ec18c9e1fa283f53","observation_id":"d1dfbc5e-d755-4bcb-9f3a-b38169a24809","resolution":{"observed_at":"2026-08-11T14:59:21.731735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06618","last_updated":"2026-04-09T14:37:23Z","snapshot_observed_at":"2026-07-06T22:55:01.863342Z","submitted_at":"2026-04-08T02:59:42Z","title":"PoC-Adapt: Semantic-Aware Automated Vulnerability Reproduction with LLM Multi-Agents and Reinforcement Learning-Driven Adaptive Policy","version":2},"cited_work":{"arxiv_id":"2604.06618","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.06618","snapshot_observed_at":"2026-08-11T14:59:21.619853Z","title":"PoC-Adapt: Semantic-Aware Automated Vulnerability Reproduction with LLM Multi-Agents and Reinforcement Learning-Driven Adaptive Policy","venue":"cs.CR","work_id":"662f848c-3bb1-4b32-a577-e8295089b623","year":2026},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.112758Z"},"links":{"cited_paper":"/paper/2604.06618","citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:ed28f2e388e9ed8e1904f300967393db12af5ea86a982fd9724dc95d5c0f0f6b","observation_id":"60a5c369-9de9-4bbd-a35c-2fda88132fa2","resolution":{"observed_at":"2026-08-11T14:59:21.625299Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.01065","last_updated":"2025-05-02T07:15:22Z","snapshot_observed_at":"2026-08-17T12:59:32.300245Z","submitted_at":"2025-05-02T07:15:22Z","title":"Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation","version":1},"cited_work":{"arxiv_id":"2505.01065","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.01065","snapshot_observed_at":"2026-08-11T14:59:21.606635Z","title":"Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation","venue":"cs.CR","work_id":"b46daa4e-8d94-45f8-a3b9-ab66c0b4f7b5","year":2025},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.115774Z"},"links":{"cited_paper":"/paper/2505.01065","citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:6e7fafdb37c4fecd35b0f690b6e4b585c0c5088556980a6dd5a9902585f637ed","observation_id":"c9316492-b658-4e01-b4c2-1351facc0ad4","resolution":{"observed_at":"2026-08-11T14:59:21.609935Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.119045Z","title":"SEC-bench: Automated bench- marking of LLM agents on real-world software security tasks, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.119045Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:ad7640f45c323cce66cb10ca5990cdae0f88f8dec219ae52c81feed15594713b","observation_id":"06240eb3-caa5-4ae1-8982-09a13c19c859","resolution":{"observed_at":"2026-08-11T14:59:21.119045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.121999Z","title":"Automated vulnerability validation and verification: A large language model approach, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.121999Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:f434905d4a1706273009fb3f0e12660ab887161825722254a1dfa1a0cbdc660c","observation_id":"6f542bdc-2dd2-4900-9858-1aab64c12444","resolution":{"observed_at":"2026-08-11T14:59:21.121999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.124600Z","title":"Shell or nothing: Real-world benchmarks and memory-activated agents for automated penetration testing, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.124600Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:cd64edfe5223636da2957371a4993cc86729d79a7cd59670b6d7c1c273961024","observation_id":"5803089d-ea40-4083-a907-0e16f02c80f0","resolution":{"observed_at":"2026-08-11T14:59:21.124600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.717080Z","title":"Cve-2020-1967","venue":null,"work_id":"9a8424cc-7138-498d-97b8-7891b9b74b1d","year":2020},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.127846Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:4d160d94e1d053525f11d78fdd7cba15dab4241f5ff4a2b3a007bd543fd933e2","observation_id":"e7107df3-6e64-43ba-adec-137281b4aaa5","resolution":{"observed_at":"2026-08-11T14:59:21.721813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.705981Z","title":"Cve-2021-31162","venue":null,"work_id":"7d1aa242-37e9-407e-b36d-58ab0845c37c","year":2021},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.130988Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:a11034cc5ef0f96b8e1a338bb559365a84339c12744ca0dc4997d0c176dd4f54","observation_id":"7a1bbd3a-9b00-42dc-9851-03062c6b97e7","resolution":{"observed_at":"2026-08-11T14:59:21.709414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.695326Z","title":"Cve-2021-44228","venue":null,"work_id":"fa6c10e2-63fb-44df-b15c-b779991a41da","year":2021},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.133376Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:8aacca996e13ede51f99eeda5d906d794a705e4401f131db44aa3e25aa14c14a","observation_id":"95fb2193-4302-4002-919a-d4d807e5b642","resolution":{"observed_at":"2026-08-11T14:59:21.698634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.685849Z","title":"Cve-2022-22816","venue":null,"work_id":"7de5eceb-6127-4f76-a85a-8670b0ffc8cb","year":2022},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.135474Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:37649d8f6364727dba6d056d08a427d38250f7ae18ff791a6b995ccc147f039f","observation_id":"00495009-4a96-4cb2-93a4-dbefd281da6b","resolution":{"observed_at":"2026-08-11T14:59:21.689690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.675272Z","title":"Cve-2023-0217","venue":null,"work_id":"f853eb30-0d4c-48e1-b2a2-0d08334983f0","year":2023},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.137405Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:8a219f63d6ee89fe2186fb71b9e01e331b582f6286a9f2d7e63cc6b7aaaf14e3","observation_id":"a96a511a-d63a-49de-bbc3-012a39c3ad09","resolution":{"observed_at":"2026-08-11T14:59:21.679183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.663557Z","title":"Cve-2023-25676","venue":null,"work_id":"a834b3b5-ad62-431c-bc9e-ca155a341a2d","year":2023},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.139624Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:e39e2f805984c8fc51710d99d0403518858bffa581ed08bde25267103b0744eb","observation_id":"75fdb339-dfdf-40ce-88dc-bcc9626e46a1","resolution":{"observed_at":"2026-08-11T14:59:21.667701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.652950Z","title":"Cve-2025-30223","venue":null,"work_id":"228c6121-c493-4dbf-bf46-873b853a614c","year":2025},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.142159Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:25bfc62d3a856534dc0c6b3e844a7fa383b0d60c0acce867514b07e68770d445","observation_id":"051932f2-7da9-4c96-a5b9-452c4a7a54de","resolution":{"observed_at":"2026-08-11T14:59:21.656506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15241","last_updated":"2025-07-21T04:55:34Z","snapshot_observed_at":"2026-08-13T08:50:28.353701Z","submitted_at":"2025-07-21T04:55:34Z","title":"FaultLine: Automated Proof-of-Vulnerability Generation Using LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15241","snapshot_observed_at":"2026-08-11T14:59:21.144083Z","title":"FaultLine: Automated proof-of-vulnerability generation using LLM agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.144083Z"},"links":{"cited_paper":"/paper/2507.15241","citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:74207725439b64c3f64485be1e6f6f27c36406417122612bc424f819b234c42c","observation_id":"121e8746-34d5-4006-b594-5d76ec9184cd","resolution":{"observed_at":"2026-08-11T14:59:21.144083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.146899Z","title":"”Get in Researchers; We’re Measuring Reproducibility”: A reproducibility study of machine learning papers in tier 1 se- curity conferences","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.146899Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:4d9369af45ab64df1355b45ce0213532f4bb16b020057cc81405ce3e8f813581","observation_id":"cc4577a1-a9f2-45d0-83c6-dd8b8b9e68ce","resolution":{"observed_at":"2026-08-11T14:59:21.146899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07561","last_updated":"2024-05-09T18:15:12Z","snapshot_observed_at":"2026-08-16T13:53:56.554425Z","submitted_at":"2024-05-09T18:15:12Z","title":"Artificial Intelligence as the New Hacker: Developing Agents for Offensive Security","version":1},"cited_work":{"arxiv_id":"2406.07561","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.07561","snapshot_observed_at":"2026-08-11T14:59:21.376073Z","title":"Artificial Intelligence as the New Hacker: Developing Agents for Offensive Security","venue":"cs.CR","work_id":"264afa16-b302-45ab-a9fd-241f9fd9df76","year":2024},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.150018Z"},"links":{"cited_paper":"/paper/2406.07561","citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:714712eeef7a9036479b109820c191a376430359d6a96da59b8b2721d6d6fd1b","observation_id":"0e329e66-dde9-4e57-8ad4-3a7fb2764e8c","resolution":{"observed_at":"2026-08-11T14:59:21.381995Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.642599Z","title":"Contract- Tinker: LLM-empowered vulnerability repair for real-world smart contracts","venue":null,"work_id":"9e48ac0c-1c77-4243-ab7e-c3b9d0eda3f5","year":2024},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.153315Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:4f09ef3284932ae9d5376aac6fb8ae0a35ed1c245a8bc859334f7b25b216a6a1","observation_id":"d484c919-ee1f-4bdb-8d38-5aea5222ff80","resolution":{"observed_at":"2026-08-11T14:59:21.646448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.156187Z","title":"PATCHEV AL: A new benchmark for evaluating LLMs on patching real-world vulnerabilities, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.156187Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:cec3e92dada6a44812596881d5bcaf4a4336b9941b198ac1080a5558ec198655","observation_id":"ebc02d0a-a208-4ec6-8639-f29b534e7d7c","resolution":{"observed_at":"2026-08-11T14:59:21.156187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01236","last_updated":"2024-11-02T13:24:30Z","snapshot_observed_at":"2026-08-16T13:03:34.558691Z","submitted_at":"2024-11-02T13:24:30Z","title":"AutoPT: How Far Are We from the End2End Automated Web Penetration Testing?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01236","snapshot_observed_at":"2026-08-11T14:59:21.159703Z","title":"AutoPT: How far are we from the End2End automated web penetration testing?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.159703Z"},"links":{"cited_paper":"/paper/2411.01236","citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:6712d2397826c4a61097c32799604b69a242a5b20b01d127e5daef2304cbb91b","observation_id":"9ece5547-9224-41f4-aff0-b4fa6c490bc6","resolution":{"observed_at":"2026-08-11T14:59:21.159703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.164056Z","title":"Patch validation in automated vulnerability repair, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.164056Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:aa41fb42ac5b607b235a308ac967ea1589d7397444ffda54c6e7a9668ae845f3","observation_id":"3c4d597c-d324-4f3c-a450-2a8e05b64f1a","resolution":{"observed_at":"2026-08-11T14:59:21.164056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:59:21.631636Z","title":"Zhang, Neil Perry, Riya Dulepet, Joey Ji, Celeste Menders, Justin W","venue":null,"work_id":"02fd7038-85c9-4587-bc15-46401793de65","year":2025},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.166818Z"},"links":{"citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:318c925f512c99a980642bdbcb47524690ac9d6ee83d21fcdaa3c110a9b89368","observation_id":"43af46b6-aeb0-426a-878b-a0fd40de25c3","resolution":{"observed_at":"2026-08-11T14:59:21.636028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17332","last_updated":"2025-06-24T04:10:59Z","snapshot_observed_at":"2026-08-16T12:47:52.443525Z","submitted_at":"2025-03-21T17:32:32Z","title":"CVE-Bench: A Benchmark for AI Agents' Ability to Exploit Real-World Web Application Vulnerabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17332","snapshot_observed_at":"2026-08-11T14:59:21.169998Z","title":"CVE-Bench: A benchmark for AI agents’ ability to exploit real-world web application vulnerabilities, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T14:59:21.169998Z"},"links":{"cited_paper":"/paper/2503.17332","citing_paper":"/paper/2608.09567"},"observation_digest":"sha256:5dde8895ee675be62a055cea5ee36c3a5c6f829e3d791ea075251f8d73a7d8ff","observation_id":"93a5464a-3e34-4fb2-80e2-97f2de3efcc9","resolution":{"observed_at":"2026-08-11T14:59:21.169998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09567","last_updated":"2026-08-10T13:05:02Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-17T15:19:40.317397Z","submitted_at":"2026-08-10T13:05:02Z","title":"From Runnable to Verifiable: An Independent Reproducibility Study of LLM/Agent-Driven Vulnerability Validation Artifacts"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":3,"verified_fuzzy":11},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2608.09567."}