{"as_of":"2026-08-08T11:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6c8dfa12e563d2243f6c33810c65de74a9e36daee9d5c5770c1366d96fdd243d","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:02:54.374219Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T00:36:36.484575Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T21:10:09.278283Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"cited_work":{"arxiv_id":"2509.03331","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.03331","snapshot_observed_at":"2026-07-04T21:10:09.278283Z","title":"VulnRepairEval: An exploit-based evaluation framework for assessing large language model vulnerability repair capabilities,","venue":null,"work_id":"007cdee6-8e4f-4a4a-be74-82f398bb1a8d","year":2025},"citing_paper":{"arxiv_id":"2605.28893","last_updated":"2026-07-03T07:41:40Z","snapshot_observed_at":"2026-08-02T07:12:40.296167Z","submitted_at":"2026-05-27T08:11:37Z","title":"Towards Demystifying and Repairing LLM-in-the-Loop Vulnerabilities","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-29T11:21:33.012202Z"},"links":{"cited_paper":"/paper/2509.03331","citing_paper":"/paper/2605.28893"},"observation_digest":"sha256:14fb0cc20ff5c29892874266398c291aa64edd94c0d15223f44a6afffe5e710f","observation_id":"b7c6bc9d-3adf-4169-8b9d-9aa773a4d679","resolution":{"observed_at":"2026-06-29T11:23:20.652423Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"cited_work":{"arxiv_id":"2509.03331","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.03331","snapshot_observed_at":"2026-07-04T21:10:09.278283Z","title":"VulnRepairEval: An exploit-based evaluation framework for assessing large language model vulnerability repair capabilities,","venue":null,"work_id":"007cdee6-8e4f-4a4a-be74-82f398bb1a8d","year":2025},"citing_paper":{"arxiv_id":"2606.25973","last_updated":"2026-06-24T15:45:38Z","snapshot_observed_at":"2026-08-07T03:45:14.020128Z","submitted_at":"2026-06-24T15:45:38Z","title":"Helpful or Harmful? Evaluating LLM-Assisted Vulnerability Patching via a Human Study","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-25T19:02:45.109478Z"},"links":{"cited_paper":"/paper/2509.03331","citing_paper":"/paper/2606.25973"},"observation_digest":"sha256:895ebcf2fc957e4ab8496705c2d79e61062b448954a12cfa2e76a573d1886c9f","observation_id":"d7933b54-82de-45c3-a3a0-052065f36990","resolution":{"observed_at":"2026-07-04T21:10:09.279825Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.03331","snapshot_observed_at":"2026-08-05T00:36:36.484575Z","title":"arXiv preprint arXiv:2509.03331 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00692","last_updated":"2026-08-01T14:40:33Z","snapshot_observed_at":"2026-08-07T16:01:40.974742Z","submitted_at":"2026-08-01T14:40:33Z","title":"Vul4Py: Benchmarking Automated Vulnerability Repair in Python with Paired Exploit and Functional Oracles","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T00:36:36.484575Z"},"links":{"cited_paper":"/paper/2509.03331","citing_paper":"/paper/2608.00692"},"observation_digest":"sha256:07e80ee9f0f8a66b3117fd1b50ce985d4351a2b4eb1e6e7eabc76e42f74cf506","observation_id":"61821484-3ea5-4605-8978-8c3a73778f7f","resolution":{"observed_at":"2026-08-05T00:36:36.484575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.03331/citation-record","integrity":"/paper/2509.03331/integrity","json":"/paper/2509.03331/citation-record.json","paper":"/paper/2509.03331"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.499931Z","title":"git-apply Documentation","venue":null,"work_id":"39027a02-3a0b-4cfb-a6f2-e6dd2a0ad438","year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.215896Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:202f6aa41e13ac3a3e55405ca761b834771936bdecbbb2c679b4a59f4e9c7e80","observation_id":"1fe78373-78ef-4580-897d-c3f6e6f9c67d","resolution":{"observed_at":"2026-08-05T11:02:55.504115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.485365Z","title":"patch Command – IBM AIX Documentation","venue":null,"work_id":"22c929d5-7ef5-4dc0-835a-4dc3941e64f5","year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.221430Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:1ff2acc09c94f25e8146cbd3d092e65080d28c9fafccb71917348fad9b88ef8c","observation_id":"aae13449-36d6-4e44-82e8-f001940e9357","resolution":{"observed_at":"2026-08-05T11:02:55.489752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19828","last_updated":"2025-05-26T11:06:03Z","snapshot_observed_at":"2026-08-08T09:45:09.924539Z","submitted_at":"2025-05-26T11:06:03Z","title":"SecVulEval: Benchmarking LLMs for Real-World C/C++ Vulnerability Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19828","snapshot_observed_at":"2026-08-05T11:02:54.227103Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.227103Z"},"links":{"cited_paper":"/paper/2505.19828","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:aba1b00920b19df12b0d95107a8fcf6bf8429a9e4ba6782daed132b6c634f236","observation_id":"3335d6c9-997a-4a55-abf1-39b619b0fd84","resolution":{"observed_at":"2026-08-05T11:02:54.227103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.469151Z","title":null,"venue":null,"work_id":"c9c89a45-dfdc-400e-9901-cc6ab3cad061","year":null},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.232277Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:f8b46636742024f5421dfba147663f8473aa75424f79b356de180dfa792eb2fe","observation_id":"6aa13417-3567-4b24-87c2-647a4f7da1e2","resolution":{"observed_at":"2026-08-05T11:02:55.474274Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5960.34759","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.149477Z","title":null,"venue":null,"work_id":"3e0678d4-70da-4b9b-a602-767155493761","year":2021},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.240818Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:a9fef6674cfcfb29099d12f5ec307bd8a1197f54092fe9669eef46db24b3a6a9","observation_id":"fcf7e0e2-84fd-43bc-b1f0-4d209fe7434f","resolution":{"observed_at":"2026-08-05T11:02:55.159079Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.453060Z","title":"Smith, Donald Stufft","venue":null,"work_id":"e1e2cc5a-6216-42e3-92fe-8c1d24e4360f","year":2016},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.244993Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:51be5ba5a274f085d9974e1996e5e4887f15dfba4607b0048fc7ef55b01c6f5b","observation_id":"2160a1e4-ca25-49b7-84aa-d9015e8f31ae","resolution":{"observed_at":"2026-08-05T11:02:55.457829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.436814Z","title":"Díaz Ferreyra","venue":null,"work_id":"3b0bc9fc-3c95-44e7-9885-ed381650cd55","year":2022},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.249614Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:aa41fdfbf0f56b8a2283df1b0b79f87cacf05f841da90403ecba0d8025533994","observation_id":"51f3abce-3622-4da9-baa8-ec4d4fca65e7","resolution":{"observed_at":"2026-08-05T11:02:55.441769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-05T11:02:54.257899Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.257899Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:7affb6587a4213435bb412078b1e2e26eb9d8f4c4a4fae3d544bf4ae9ce35f67","observation_id":"fa455ae8-adb9-4dee-9914-3948c20a4cd3","resolution":{"observed_at":"2026-08-05T11:02:54.257899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.422073Z","title":null,"venue":null,"work_id":"2d13bb5f-750a-41b7-a37c-c805a1c0a0c1","year":2020},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.262484Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:c1000b06f062377f9fe3fe360b1d7f74817040f2a0ca49e1493b74365643eb8e","observation_id":"32531a87-5e05-4bb2-9c9f-a93a7e93b598","resolution":{"observed_at":"2026-08-05T11:02:55.426094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.405514Z","title":"2024.{PentestGPT}: Evaluating and harnessing large language models for automated penetration testing","venue":null,"work_id":"f1deaf4d-984e-4a9a-ab6e-88914acf6947","year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.266534Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:c6a44922da459c72389d23c13d30b88513cb30d2c6ccc84cffc8421eaac976cb","observation_id":"ccacb866-ac59-4ebe-a5de-aad7dd7a32c3","resolution":{"observed_at":"2026-08-05T11:02:55.410264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T11:02:54.270368Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.270368Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:ac11e5013b00a1f906c9bef80f25bbbac89609e1950ff7eb387db7d648e03b08","observation_id":"9975aef7-e0ce-43ae-bcf8-fa8bb060bcba","resolution":{"observed_at":"2026-08-05T11:02:54.270368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11697","last_updated":"2025-06-13T11:59:04Z","snapshot_observed_at":"2026-08-07T04:01:53.495875Z","submitted_at":"2025-06-13T11:59:04Z","title":"SoK: Automated Vulnerability Repair: Methods, Tools, and Assessments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11697","snapshot_observed_at":"2026-08-05T11:02:54.274440Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.274440Z"},"links":{"cited_paper":"/paper/2506.11697","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:3e3074bb8e136290050084bbff44fec4fd771d89d9f416f7c8559fe37ad44672","observation_id":"eda7427e-65f4-4ccb-a686-4742b5b712b8","resolution":{"observed_at":"2026-08-05T11:02:54.274440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T11:02:54.278555Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.278555Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:71f21e65a4b8ae751c1896637f97221e817fa9c768486da715a4048b3cb553ba","observation_id":"78c2840b-a16b-462f-8517-8453d680abe7","resolution":{"observed_at":"2026-08-05T11:02:54.278555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-05T11:02:54.282800Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.282800Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:e6ce4fefb823b155c6c30e55b2293e89e68bafeedf77f18d56fc5e72a5f32007","observation_id":"fa2a095b-71c5-4e85-9e5c-17d13bc37afb","resolution":{"observed_at":"2026-08-05T11:02:54.282800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/2610384","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.428096Z","title":null,"venue":null,"work_id":"756f23bd-5950-43ed-b64f-80651393a897","year":2014},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.286766Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:999a39e2e0424b3d91b8cac0cfa27b705632883d184461377dd1c08192d48f18","observation_id":"c5ce7e3e-d9f2-482e-8a85-40c6ff2a6991","resolution":{"observed_at":"2026-08-05T11:02:54.433629Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-05T11:02:54.290488Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.290488Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:c01b2f6a282159ae98210aafbe2547f021fe891f2a9bafa677f38a5674c2d3fb","observation_id":"94b8e3ec-25f3-4208-a029-5e9f5af06b14","resolution":{"observed_at":"2026-08-05T11:02:54.290488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8499.2023","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.859260Z","title":null,"venue":null,"work_id":"8212c541-dd3d-430f-b896-3a0e94b39b5a","year":2023},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.294508Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:89ac5a945bde8c9d6fe68db8a0d62c2db88ee8b56a8a28049f25c94a09568837","observation_id":"b19cda7d-ec03-4ea9-a087-29efc38f48da","resolution":{"observed_at":"2026-08-05T11:02:54.868133Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.298556Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.298556Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:c03b0be19329c02dd9e6161dd3ccc6b740e489c722eb40e607267d55d8615050","observation_id":"daf00636-cbd1-45d5-af4b-823bc58e582e","resolution":{"observed_at":"2026-08-05T11:02:54.298556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.302738Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.302738Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:858e2baaf12920cf915117b4f84b1a7890da63a547ea22e080a5cb8b71ffaac4","observation_id":"5c25037c-6566-4125-9537-c9bb6f45048b","resolution":{"observed_at":"2026-08-05T11:02:54.302738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.389601Z","title":null,"venue":null,"work_id":"154c1f9b-e27b-4e59-b12f-da74dcb40cb7","year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.306710Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:99ba5b4b73d836a177f3a36eda49a38922cbe49abe10271f255514bfe3f2e1b3","observation_id":"f87cfc28-6fc0-4aef-b2b0-e21b1884ea57","resolution":{"observed_at":"2026-08-05T11:02:55.394487Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.373975Z","title":null,"venue":null,"work_id":"0d0d270e-14ef-4e31-a5f2-ee2d3957a1c7","year":2021},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.310590Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:03b5f69107f589a37110c0071c1b121c58868855181a32dd22ef23fb04efedd1","observation_id":"638c9e38-958c-4a99-8720-cfd443933dee","resolution":{"observed_at":"2026-08-05T11:02:55.378799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.355856Z","title":null,"venue":null,"work_id":"c18f4714-3c8b-4d9d-837c-6bbdacbdb1e5","year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.314475Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:6f0381047055c86ced32327c3e684e547867537219cc29c79e6d24f427e373b8","observation_id":"dd2a5acd-51d3-4125-9988-298a3e56e04c","resolution":{"observed_at":"2026-08-05T11:02:55.360546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.341079Z","title":null,"venue":null,"work_id":"a4eff38f-1a48-4b65-beb7-e2c9afffb7ee","year":2023},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.318435Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:a7368d2cd39d42d71ce23e1e6157937be33a16c346776e92505a78f0f658c2be","observation_id":"dae2b195-b9f8-4b0a-bf7a-c0d0fe8dace1","resolution":{"observed_at":"2026-08-05T11:02:55.345392Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.325776Z","title":null,"venue":null,"work_id":"b271c8a6-40fc-41e3-b362-5981e61c11f3","year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.322331Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:3d0a691255f03bf9513a678cdb0c2957a534d87e8aa2fb56a848d7a56248bd4a","observation_id":"894ea19f-28fb-40ab-82a3-0d38da2b47f9","resolution":{"observed_at":"2026-08-05T11:02:55.330514Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10443","last_updated":"2026-05-07T08:39:34Z","snapshot_observed_at":"2026-08-02T12:51:54.815471Z","submitted_at":"2025-05-15T16:04:25Z","title":"Are Large Language Models Robust in Understanding Code Against Semantics-Preserving Mutations?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10443","snapshot_observed_at":"2026-08-05T11:02:54.326649Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.326649Z"},"links":{"cited_paper":"/paper/2505.10443","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:4d6b5e9fc45a82d1c07cf7b22b7776e4a9750f6e3437f22dade5ef6c16bf4208","observation_id":"d68be404-6158-48e5-84aa-bd3386653d12","resolution":{"observed_at":"2026-08-05T11:02:54.326649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04962","last_updated":"2026-06-28T09:23:55Z","snapshot_observed_at":"2026-08-07T10:27:10.848359Z","submitted_at":"2025-06-05T12:37:33Z","title":"PoCGen: Generating Proof-of-Concept Exploits for Vulnerabilities in Npm Packages","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04962","snapshot_observed_at":"2026-08-05T11:02:54.330975Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.330975Z"},"links":{"cited_paper":"/paper/2506.04962","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:0f0b89584d52a064f30381949423fe5c5f2a7d1ab67f4cced47614be91c0603d","observation_id":"4027879f-411b-4ce2-82d8-470bf078a7db","resolution":{"observed_at":"2026-08-05T11:02:54.330975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.310701Z","title":null,"venue":null,"work_id":"5c54489f-456a-40ad-810c-690bcd439d47","year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.335305Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:646bc334ec59286559b51c0c859054f6e4340b44672e0c31a954ff183c9e72c6","observation_id":"93938fae-9036-4db6-8c12-d5deee521d12","resolution":{"observed_at":"2026-08-05T11:02:55.314977Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.292037Z","title":null,"venue":null,"work_id":"d72a12ed-bd1d-445b-9133-b5c52bc302ac","year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.339819Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:bc583a00c34b8bb6e468f7c762d9aff97f7209171627c795d550cee7592aeae9","observation_id":"d0b7014b-3e98-4d3c-af4d-aa9436733ee1","resolution":{"observed_at":"2026-08-05T11:02:55.296795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.344033Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.344033Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:b22a414b9ac877496d83b1ad2a6ca18db6ccbd398d62e59bfd707a5eaee2c757","observation_id":"8a98f66b-e71a-4e1a-ac0c-fdf38f97bfa9","resolution":{"observed_at":"2026-08-05T11:02:54.344033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9478.36476","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.729732Z","title":null,"venue":null,"work_id":"6809ab0c-c83c-4b02-82eb-2dd551af5f20","year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.348211Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:e6ef77fb253b1518db140e39351d1519fb77189d06d599f47d642a447e0a3ded","observation_id":"9cd4b76a-358a-491e-9a76-0e1296531cd4","resolution":{"observed_at":"2026-08-05T11:02:54.738213Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:55.264085Z","title":"Chi, Quoc V","venue":null,"work_id":"9b48b343-f59e-45fc-96ba-3848bfbfd10a","year":2022},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.352409Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:9968daa937249b16cf4e45bff441699b2e17598a850c04cbf321a2ac857a11f9","observation_id":"fbd3072f-6bfa-4d4c-a6dc-f74e563abc10","resolution":{"observed_at":"2026-08-05T11:02:55.268973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18449","last_updated":"2025-12-01T00:16:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-25T18:45:04Z","title":"SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18449","snapshot_observed_at":"2026-08-05T11:02:54.356699Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.356699Z"},"links":{"cited_paper":"/paper/2502.18449","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:2b5c2b355dfa557d6f32b5df0c3b6f9630543c23da6a8bcdea043fbe0328c2a8","observation_id":"9acab7d4-dcaa-44f8-956e-afa3feefab96","resolution":{"observed_at":"2026-08-05T11:02:54.356699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.361313Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.361313Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:dafc9b8834e7060f5794cbf7447550e2984e6d81f3a4d7780729b12dd9e47237","observation_id":"4510945b-4e26-41f5-82ba-5f17b02228d2","resolution":{"observed_at":"2026-08-05T11:02:54.361313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-05T11:02:54.365718Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.365718Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:bba3bfe9c570f447396be09d6b660736cd2e3dadf6ede380faff3daea8e6e046","observation_id":"6bec30c8-092d-490b-9c66-b16ad0df4e5b","resolution":{"observed_at":"2026-08-05T11:02:54.365718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15793","last_updated":"2024-11-11T20:01:15Z","snapshot_observed_at":"2026-07-06T18:19:29.996982Z","submitted_at":"2024-05-06T17:41:33Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15793","snapshot_observed_at":"2026-08-05T11:02:54.369975Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.369975Z"},"links":{"cited_paper":"/paper/2405.15793","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:99f0fe1e24bba3f15b25ca04c3646c1a50b547d6ed726ee04e6f2ce02e8bf1ad","observation_id":"70468bcb-b603-4346-9b14-e217fe97db3e","resolution":{"observed_at":"2026-08-05T11:02:54.369975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15877","last_updated":"2025-04-01T08:36:44Z","snapshot_observed_at":"2026-07-31T19:00:59.311189Z","submitted_at":"2024-06-22T15:52:04Z","title":"BigCodeBench: Benchmarking Code Generation with Diverse Function Calls and Complex Instructions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15877","snapshot_observed_at":"2026-08-05T11:02:54.374219Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.374219Z"},"links":{"cited_paper":"/paper/2406.15877","citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:354ba3d8c81e819c55a9aed80c2b905330e8bb011b026dcd699d3a4c4db35d23","observation_id":"4eee2536-09a9-429d-a48e-5bb0e504d29c","resolution":{"observed_at":"2026-08-05T11:02:54.374219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.253699Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":468,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.253699Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:e9392c81dadfa280f5f2a55d79c3fb37ac946262a3c24befc6e6750a7ca9e703","observation_id":"5ae84726-e274-437f-98ff-e1aace6cfe89","resolution":{"observed_at":"2026-08-05T11:02:54.253699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T11:02:54.236609Z","title":"In Proceedings of the 20th International Confer- ence on Predictive Models and Data Analytics in Software Engineering (PROMISE 2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T11:02:54.236609Z"},"links":{"citing_paper":"/paper/2509.03331"},"observation_digest":"sha256:fd2416ae5cfccee1e6f7b4122ca1382fc83c3b8f0985e9231ae1fcc740616a8e","observation_id":"0e0f64d6-918a-46ff-974b-6e73324bd0a2","resolution":{"observed_at":"2026-08-05T11:02:54.236609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.03331","last_updated":"2025-09-03T14:06:10Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-05T11:02:53.106284Z","submitted_at":"2025-09-03T14:06:10Z","title":"VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":28,"verified_exact":2,"verified_fuzzy":6},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 3 inbound Pith citation observations for arXiv:2509.03331."}