{"as_of":"2026-08-07T05:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:62e24efd8069044cfd5627619bfdd77522107e42f2afd9cabb5aea2f2ab8ca99","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T16:59:23.799306Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.02001/citation-record","integrity":"/paper/2608.02001/integrity","json":"/paper/2608.02001/citation-record.json","paper":"/paper/2608.02001"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.737579Z","title":"https://github.com/open-webui/open-webui","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.737579Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:5ad60c0fc2f5ffbbfa881ca43c960a888860a5113d380cebd4aebcaf4672c634","observation_id":"74f8c860-9cec-4b1a-9030-e12919e8c931","resolution":{"observed_at":"2026-08-04T16:59:23.737579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.745361Z","title":"https://github","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.745361Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:0db731ae272175dca69ecad2a6e24c521bcce096163480e8134c287ee5c77a96","observation_id":"39a83edb-52cb-427c-bbce-b973ec1464fc","resolution":{"observed_at":"2026-08-04T16:59:23.745361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.753820Z","title":"InInternational Conference on Learning Representations, volume 2024, 23247–23275","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.753820Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:e185dd76e4cf23fd4dae97c51c782ce39c0d6625648f89be7ea3260766453f4c","observation_id":"b3db10a9-4a33-430a-9e36-f0a1d9a04338","resolution":{"observed_at":"2026-08-04T16:59:23.753820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.757541Z","title":"InIn- ternational conference on learning representations, volume 2025, 35735–35758","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.757541Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:48d6d56f257cc2a29fcf426e03ef01d2d2866e8b3a3e0553b895fc12f25e4fa4","observation_id":"c00bc3b4-f4e4-471a-8da8-f73b2b3f26eb","resolution":{"observed_at":"2026-08-04T16:59:23.757541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.761428Z","title":"InFindings of the Association for Compu- tational Linguistics: ACL 2026, 31390–31405","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.761428Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:99119a8827faacc7a9e55fa7b0851ed58e9c6d7b6ec7806c51b4b37172b12360","observation_id":"b85453db-0a64-4f0f-98e5-6b66a2f9b14f","resolution":{"observed_at":"2026-08-04T16:59:23.761428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07595","last_updated":"2024-08-21T14:51:06Z","snapshot_observed_at":"2026-08-02T01:54:06.209062Z","submitted_at":"2024-06-11T13:42:57Z","title":"VulDetectBench: Evaluating the Deep Capability of Vulnerability Detection with Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07595","snapshot_observed_at":"2026-08-04T16:59:23.765035Z","title":"arXiv preprint arXiv:2406.07595","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.765035Z"},"links":{"cited_paper":"/paper/2406.07595","citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:120443fa7f604d34f4a786cb6d0fb0d48fa8f2e3dff3e85b1de5b78bcef84247","observation_id":"0049addd-b049-47cf-9033-f47aa6ea3e62","resolution":{"observed_at":"2026-08-04T16:59:23.765035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.769001Z","title":"https://www","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.769001Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:80e8a139be9c4ea530be3d104aee1d92290ac68cfe598ab30dd3bab14d493e16","observation_id":"7bb032b8-ff55-4e57-a526-7de1da75958d","resolution":{"observed_at":"2026-08-04T16:59:23.769001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.772700Z","title":"https://qwen.ai/blog?id=qwen3.5","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.772700Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:af8e86f2f48c3f3f80eb574fb2ecbba30639cc9a07cb34ac0a5806a2a81405ea","observation_id":"b4bba677-3a14-4d85-939b-4a315c794c88","resolution":{"observed_at":"2026-08-04T16:59:23.772700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.780503Z","title":"InProceedings of the 2024 IEEE/ACM 46th International Conference on Software Engineering: Com- panion Proceedings, 472–483","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.780503Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:38d622425b54d0c4791f488024dc4966c8e4bdb3ee2126bc9278b2ebc71cb4f1","observation_id":"63137670-e12f-4dad-a8cb-8778a0bdc5a0","resolution":{"observed_at":"2026-08-04T16:59:23.780503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.784250Z","title":"Wen, X.-C.; Wang, X.; Chen, Y.; Hu, R.; Lo, D.; and Gao, C.2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.784250Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:626f5e056ed3f6183519b1ec81007a4899e422015bd7cbb9aba03a82c30f26d7","observation_id":"9fecfbe0-4b3e-418b-b00a-abab4bf6a9fb","resolution":{"observed_at":"2026-08-04T16:59:23.784250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.787981Z","title":"arXiv preprint arXiv:2606.19348","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.787981Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:f2ab05223b33752c09cdf45e7bd00f1d40263cda5dce6b8435ff2e9e95c26dbf","observation_id":"9d44f15e-28dc-4e72-a8a1-714935beb87b","resolution":{"observed_at":"2026-08-04T16:59:23.787981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.795641Z","title":"https: //z.ai/blog/glm-5.2","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.795641Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:15afc4e43e700ff09e3d5ca24e993ec2bd6942da21b75c0da9635e962b28fd35","observation_id":"72dac9d1-c1d2-483b-bed0-6c7710f3e632","resolution":{"observed_at":"2026-08-04T16:59:23.795641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06215","last_updated":"2025-02-10T07:33:49Z","snapshot_observed_at":"2026-07-06T20:33:48.242475Z","submitted_at":"2025-02-10T07:33:49Z","title":"LessLeak-Bench: A First Investigation of Data Leakage in LLMs Across 83 Software Engineering Benchmarks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06215","snapshot_observed_at":"2026-08-04T16:59:23.799306Z","title":"InPro- ceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers),13643– 13658","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.799306Z"},"links":{"cited_paper":"/paper/2502.06215","citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:71431d5e31b6b7b776b347097c1e150a07ad01f705500a4958a39c1d995fb1fa","observation_id":"f5cea68f-dda0-4af7-9142-4fcaa620feb4","resolution":{"observed_at":"2026-08-04T16:59:23.799306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.791723Z","title":"InNeurIPS 2022 Foundation Models for Decision Making Workshop","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.791723Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:6ba977781aca1a9418c54477791468992c33acfcdff59a59966617125fa7a6ad","observation_id":"dc85066b-a0fd-4c72-af12-8cd9476ba664","resolution":{"observed_at":"2026-08-04T16:59:23.791723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.776973Z","title":"Tamberg,K.;andBahsi,H.2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.776973Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:1e56a28d1ab08019d956e00a0fa29872f753de63f8d7f2d04beb4516d815dfe0","observation_id":"6552effe-f4af-40df-bf61-6c11cca1b32c","resolution":{"observed_at":"2026-08-04T16:59:23.776973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18624","last_updated":"2024-07-10T05:26:17Z","snapshot_observed_at":"2026-08-02T22:53:11.658483Z","submitted_at":"2024-03-27T14:34:29Z","title":"Vulnerability Detection with Code Language Models: How Far Are We?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.18624","snapshot_observed_at":"2026-08-04T16:59:23.741337Z","title":"Fan, J.; Li, Y.; Wang, S.; and Nguyen, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.741337Z"},"links":{"cited_paper":"/paper/2403.18624","citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:31f91ebdf4f50022a95465fd601916c92b9363db7cac2683744bb4c6a41631d0","observation_id":"a5d4ab5d-4822-460c-a52a-ae58827849fe","resolution":{"observed_at":"2026-08-04T16:59:23.741337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.749534Z","title":"Insert Prompt as Rich Text","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.749534Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:3abb9abb0741bcde5e694f9f412360ef4ec6809c5303b22610d406a9012e30d6","observation_id":"6bc2a092-ec91-4651-994d-c97fb7e41a44","resolution":{"observed_at":"2026-08-04T16:59:23.749534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:59:23.732754Z","title":"https: //www.cursor.com/","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-04T16:59:23.732754Z"},"links":{"citing_paper":"/paper/2608.02001"},"observation_digest":"sha256:6d0bbc44591b9433dd36a7146bbd5e1378ef4f84aab12993fd3c12735e64d4a6","observation_id":"04deb685-19f1-4fe4-89e3-5c67a2dc4399","resolution":{"observed_at":"2026-08-04T16:59:23.732754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.02001","last_updated":"2026-08-03T10:03:29Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-07T05:09:30.975192Z","submitted_at":"2026-08-03T10:03:29Z","title":"VulnGym: Benchmarking Coding Agents for Repository-Level Vulnerability Detection"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2608.02001."}