{"as_of":"2026-08-18T09:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ab3248c116ffc6a7642d46948b43ca1f44ae7640c76c60df0c640230b91cef10","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T10:23:23.447306Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.27288/citation-record","integrity":"/paper/2607.27288/integrity","json":"/paper/2607.27288/citation-record.json","paper":"/paper/2607.27288"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.04926","last_updated":"2023-03-08T22:37:50Z","snapshot_observed_at":"2026-08-16T15:49:40.836796Z","submitted_at":"2023-03-08T22:37:50Z","title":"Automated Cyber Defence: A Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04926","snapshot_observed_at":"2026-08-01T10:23:17.663945Z","title":"Automated cyber defence: A review","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:17.663945Z"},"links":{"cited_paper":"/paper/2303.04926","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:ddc8b04a241eae22a81aad0c8c044e4f528d71197453bef78adfcaba4bf92aa7","observation_id":"a87f9ed1-75c3-4163-bcaa-b4054bc04f19","resolution":{"observed_at":"2026-08-01T10:23:17.663945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.09118","last_updated":"2021-08-20T11:32:23Z","snapshot_observed_at":"2026-08-16T18:02:04.016872Z","submitted_at":"2021-08-20T11:32:23Z","title":"CybORG: A Gym for the Development of Autonomous Cyber Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.09118","snapshot_observed_at":"2026-08-01T10:23:17.714760Z","title":"Richer, Junae Kim, and Damian Marriott","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:17.714760Z"},"links":{"cited_paper":"/paper/2108.09118","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:32cc4d77e82d6b5b68bee10ece3cd17cb0527bfba0f20d367fbabbb1dc146693","observation_id":"c487aaab-4e49-48f4-8938-1227e983659e","resolution":{"observed_at":"2026-08-01T10:23:17.714760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:17.790602Z","title":null,"venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:17.790602Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:17d9d41cffa94511a052bb3695472cbb85663e474dbd6d7089df7b6b8eb20b9e","observation_id":"7257376a-f72b-419d-b682-292c7f410f2e","resolution":{"observed_at":"2026-08-01T10:23:17.790602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:17.832327Z","title":"Cyber situational awareness - a systematic review of the literature","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:17.832327Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:1c15e6cb617382ecc3fcec8f43cb168d1ee69904d4e30b4f8130907ee3a2a519","observation_id":"9afcfe4c-7550-475a-b811-504e6467144d","resolution":{"observed_at":"2026-08-01T10:23:17.832327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:17.884027Z","title":"Defining identity security posture management (ispm)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:17.884027Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:7872dfe2fff31191a1572bb36ebf3380b0510f3471fe010775a9f889225e215f","observation_id":"43405d80-5a84-476e-8b12-4aeeab360065","resolution":{"observed_at":"2026-08-01T10:23:17.884027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:18.006431Z","title":"Cloud controls matrix (ccm) v4","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.006431Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:11027e15e55d7cd9e4bf9bf1820d20016c4df89b2066271ceaf86d8e4333baf1","observation_id":"8a57994f-1939-46f1-a0aa-47d63b3d437e","resolution":{"observed_at":"2026-08-01T10:23:18.006431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:18.062262Z","title":"Guide for mapping types of information and information systems to security categories","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.062262Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:4dbcc45fe2f12df18bd2d0e00ee8ded89e20f73d0240f4d96c2a1770955d1042","observation_id":"c9b48b69-b79e-4954-94e2-09d5b6e47d27","resolution":{"observed_at":"2026-08-01T10:23:18.062262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:18.114163Z","title":"OWASP top 10:2021 - the ten most critical web application security risks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.114163Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:ef6d2226baeb0caec7b581f0d48d974296e53fa095b66993f6acaaa8ae3f3975","observation_id":"3923b4a0-8d9e-43ba-b8e1-4c46c226c1d2","resolution":{"observed_at":"2026-08-01T10:23:18.114163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:18.177446Z","title":"Cybersecurity supply chain risk management practices for systems and organizations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.177446Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:5b66868fa2570545c691e5573be7886bc515a1cdd24c2ef6e707c52d70ff43c4","observation_id":"6afff3c7-d8fd-4724-aea9-e94cb6f99661","resolution":{"observed_at":"2026-08-01T10:23:18.177446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:18.215574Z","title":"The NIST cybersecurity framework (CSF) 2.0","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.215574Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:38138d63d69e816bd9348dfe0a614cae1c4a021f67c31e959b49e0adf28fbe4f","observation_id":"73f5b897-f4ac-43f8-a2df-2dfcee6d5f39","resolution":{"observed_at":"2026-08-01T10:23:18.215574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:18.265066Z","title":"Security and privacy controls for information systems and organizations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.265066Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:5847ee8d0aeac13f2ae5e507ccabb72ac8f3718225ddee841fe9fe309c7ecae5","observation_id":"6f91e672-73d3-4724-8c15-153d87359bc5","resolution":{"observed_at":"2026-08-01T10:23:18.265066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:18.320044Z","title":"Cis critical security controls, version 8.https://www.cisecurity.org/ controls/v8, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.320044Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:f9b94aebe7f27eae5733e368b8062240ef7741261124728aa7535f227aee1df9","observation_id":"41c3767e-987e-472b-8a37-997d48bc916f","resolution":{"observed_at":"2026-08-01T10:23:18.320044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:18.379233Z","title":"Iso/iec 27001:2022 - information security, cybersecurity and privacy protection - information security management systems - requirements.https://www.iso","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.379233Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:a35ebac373de9059f9a5c93d8c907b8bd2608e3e557dce07625945347377241e","observation_id":"8aad9d8c-a359-4be6-8fa8-e7bea3282b76","resolution":{"observed_at":"2026-08-01T10:23:18.379233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:18.491658Z","title":"Scout suite: Multi-cloud security auditing tool","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.491658Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:340c9754e37798ef72a397401fcc73613ba2adcce1e8d282cfc832e07d06cc32","observation_id":"9695ec47-f9ba-4e86-9458-5ba701f311ea","resolution":{"observed_at":"2026-08-01T10:23:18.491658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:18.557639Z","title":"Prowler: Open source cloud security tool for aws, azure, gcp and kubernetes","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.557639Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:af446e933cfe860910977ccc88a8305b6d372d0208e337f914ae57bae0d6382f","observation_id":"c3fe50f6-12e1-4dd4-a47f-6a9d3beb563d","resolution":{"observed_at":"2026-08-01T10:23:18.557639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:18.620480Z","title":"Scubagoggles: Google workspace secure configuration baseline assessment tool.https://github.com/cisagov/ScubaGoggles, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.620480Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:34a23b4cf2c322fd386ac99057048e4e4d36f06558f5be20357a951e42d6f10f","observation_id":"d66c68a7-bd21-40d5-a72b-a3390354b4b0","resolution":{"observed_at":"2026-08-01T10:23:18.620480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:18.702690Z","title":"2025 roi of ai in security report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.702690Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:c3fe6b282d8369c69c468522b6e6aef1c6231c7394a8318057c6f7ed866f5448","observation_id":"9a182b19-0580-4081-823f-9ab6d450dcd0","resolution":{"observed_at":"2026-08-01T10:23:18.702690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14201","last_updated":"2026-05-01T04:31:46Z","snapshot_observed_at":"2026-08-11T04:21:18.267564Z","submitted_at":"2025-07-14T17:06:26Z","title":"ExCyTIn-Bench: Evaluating LLM agents on Cyber Threat Investigation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.14201","snapshot_observed_at":"2026-08-01T10:23:18.770346Z","title":"Roy, Quang Nguyen, Roberto Rodriguez, Qingyun Wu, Michael Albada, Julia Kiseleva, and Anand Mudgerikar","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.770346Z"},"links":{"cited_paper":"/paper/2507.14201","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:828cd3fce0e9b543de4cf42c8a1ca0ea8d0964fbd233565e39d716e3ec2a59de","observation_id":"b70f34d5-5b6e-42de-a7da-c7979359f1e4","resolution":{"observed_at":"2026-08-01T10:23:18.770346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19165","last_updated":"2025-06-17T16:48:29Z","snapshot_observed_at":"2026-08-15T16:25:41.327069Z","submitted_at":"2025-05-25T14:30:15Z","title":"OrgAccess: A Benchmark for Role Based Access Control in Organization Scale LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19165","snapshot_observed_at":"2026-08-01T10:23:18.845950Z","title":"Orgaccess: A benchmark for role based access control in organization scale llms.arXiv preprint arXiv:2505.19165, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.845950Z"},"links":{"cited_paper":"/paper/2505.19165","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:b2c8a4908753c9c8a2508d069c479c97859a046671167e9e2dcfccbce234633d","observation_id":"114b1788-e673-4817-a7c9-677ef9b37c8a","resolution":{"observed_at":"2026-08-01T10:23:18.845950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13161","last_updated":"2024-04-19T20:11:12Z","snapshot_observed_at":"2026-08-16T13:59:21.695627Z","submitted_at":"2024-04-19T20:11:12Z","title":"CyberSecEval 2: A Wide-Ranging Cybersecurity Evaluation Suite for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13161","snapshot_observed_at":"2026-08-01T10:23:18.965629Z","title":"Cyberseceval 2: A wide-ranging cybersecurity evaluation suite for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:18.965629Z"},"links":{"cited_paper":"/paper/2404.13161","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:9d68cf1c23862262dbefa28d4a5c1f5f2cabe3bf748f47d15ca91523999edc30","observation_id":"7bcc2ffd-c08e-4997-8666-ef1f0ab4bd5c","resolution":{"observed_at":"2026-08-01T10:23:18.965629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:19.112806Z","title":"Zhang, Neil Perry, Riya Dulepet, Joey Ji, Celeste Menders, Justin W","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:19.112806Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:684934d8ba68f0fba15dbfe851c792295225a72cce5552be530d3eee8241c446","observation_id":"de5dda42-3adb-42aa-b016-883e20466e6c","resolution":{"observed_at":"2026-08-01T10:23:19.112806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05590","last_updated":"2025-02-18T12:26:33Z","snapshot_observed_at":"2026-08-16T20:14:18.570887Z","submitted_at":"2024-06-08T22:21:42Z","title":"NYU CTF Bench: A Scalable Open-Source Benchmark Dataset for Evaluating LLMs in Offensive Security","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05590","snapshot_observed_at":"2026-08-01T10:23:19.237266Z","title":"Nyu ctf bench: A scalable open-source benchmark dataset for evaluating llms in offensive security.arXiv preprint arXiv:2406.05590, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:19.237266Z"},"links":{"cited_paper":"/paper/2406.05590","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:5c8e280d7c96d8cd2823220f2ceec718a487a20b2c8d790ee2d0f3784e44b01f","observation_id":"ff095c14-b3bc-4ac3-910d-20329497c5a8","resolution":{"observed_at":"2026-08-01T10:23:19.237266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:19.363885Z","title":"Semantic parsing on Freebase from question-answer pairs","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:19.363885Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:107a5d439c5b49110aa79c5c8773093176bc3071369d5f09958123ea3dcb0cc8","observation_id":"780aa95f-3273-42b5-9e60-9c1b3d5dfa4b","resolution":{"observed_at":"2026-08-01T10:23:19.363885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:19.491705Z","title":"Spider: A large-scale human-labeled dataset for complex and cross-domain semantic parsing and text-to-sql task","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:19.491705Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:4b09f49fdc2c2bcb80297d1cac69e78495cdfab80379e0de47f6e8a33ecdf0ea","observation_id":"f2200b34-141a-4ca3-9013-9c561f3a0231","resolution":{"observed_at":"2026-08-01T10:23:19.491705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:19.634428Z","title":"Chang, Fei Huang, Reynold Cheng, and Yongbin Li","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:19.634428Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:18708b9383e7e621b66dc471e0a7de616a6872bce751899c3a4c3418730aa08a","observation_id":"20210221-84cc-47e6-9aeb-ba7fe3a8d26a","resolution":{"observed_at":"2026-08-01T10:23:19.634428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07763","last_updated":"2025-03-17T16:10:45Z","snapshot_observed_at":"2026-08-16T13:00:50.088978Z","submitted_at":"2024-11-12T12:52:17Z","title":"Spider 2.0: Evaluating Language Models on Real-World Enterprise Text-to-SQL Workflows","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07763","snapshot_observed_at":"2026-08-01T10:23:19.750534Z","title":"Spider 2.0: Evaluating language models on real-world enterprise text-to-sql workflows.arXiv preprint arXiv:2411.07763, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:19.750534Z"},"links":{"cited_paper":"/paper/2411.07763","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:a64f3a5c452324f94091021102b7574367573fd906f279f86b201ad7eba220f7","observation_id":"6f04a2a8-578d-432d-9f21-5e31cede2bb7","resolution":{"observed_at":"2026-08-01T10:23:19.750534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:19.866455Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:19.866455Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:998d85d8fb87754c22b24a4b709306928c9acc4cc148852de6afaeb7982f4813","observation_id":"c73b3c95-37b0-4665-9c3e-f36a2e09c160","resolution":{"observed_at":"2026-08-01T10:23:19.866455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:19.981337Z","title":"Jimenez, Alexander Wettig, Kilian Lieret, Shunyu Yao, Karthik Narasimhan, and Ofir Press","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:19.981337Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:180c19f971d680495ded701acd3947690f6f8d752421f1ab86ed6726e6521932","observation_id":"68848885-24fb-47ac-8388-ced1d55dabea","resolution":{"observed_at":"2026-08-01T10:23:19.981337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:20.096332Z","title":"Sola-visibility-ispm: Benchmarking agentic ai for identity security posture management visibility.arXiv preprint arXiv:2601.07880, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:20.096332Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:b1220bd6dcda73456ae3edf042c62726f88df1fbafc697fbc3faac58afb60169","observation_id":"e1f6d8d1-546a-4723-86ea-c6f3ed068f1f","resolution":{"observed_at":"2026-08-01T10:23:20.096332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.02674","last_updated":"2026-06-01T12:41:00Z","snapshot_observed_at":"2026-08-14T07:50:25.320317Z","submitted_at":"2026-06-01T12:41:00Z","title":"Cross-Vendor Sola ISPM Benchmark: Evaluating Agentic AI for Federated Identity Security Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.02674","snapshot_observed_at":"2026-08-01T10:23:20.208459Z","title":"Cross-vendor sola ispm benchmark: Evaluating agentic ai for federated identity security reasoning.arXiv preprint arXiv:2606.02674, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:20.208459Z"},"links":{"cited_paper":"/paper/2606.02674","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:524f8e09ca417d5fd9be468c333ab88ac11e499e61abbaff19792fa13b1d41ac","observation_id":"47bccb5b-34db-4673-b7b1-df1a9c613393","resolution":{"observed_at":"2026-08-01T10:23:20.208459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:20.317004Z","title":"Guide for conducting risk assessments","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:20.317004Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:0faf0d52aa2d7f76ebadd2f31d1fc033d0b1aea5778f83862b0de13ad793618f","observation_id":"681b4bab-4ed5-4cec-8656-d65e92416c15","resolution":{"observed_at":"2026-08-01T10:23:20.317004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:20.423451Z","title":"Guide to enterprise patch management planning: Preventive maintenance for technology","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:20.423451Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:b7e1f8f2d1cdf1799800b37a7481f5a25d09212ec397692757414ca6fb61dd3e","observation_id":"d2fec3d8-24d6-4113-96e6-782d5db22338","resolution":{"observed_at":"2026-08-01T10:23:20.423451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:20.544307Z","title":"Information security continuous monitoring (iscm) for federal information systems and organizations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:20.544307Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:263b9677767ab928028ee618c3d1dcb2c7df5cbcee04e5d6981e0fa3ec11c076","observation_id":"e8fa921e-0bf0-4b58-8e85-a9219c0d2e08","resolution":{"observed_at":"2026-08-01T10:23:20.544307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:20.641773Z","title":"Cybersoceval: Benchmarking llms capabilities for malware analysis and threat intelligence reasoning.arXiv preprint arXiv:2509.20166, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:20.641773Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:2a7dcb46da8e01679d4bb46b663a3094e25a2d290da5185cad89c4866a53de86","observation_id":"539aa29b-3011-4f94-b005-29f1542b5a64","resolution":{"observed_at":"2026-08-01T10:23:20.641773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07599","last_updated":"2024-11-11T12:00:35Z","snapshot_observed_at":"2026-08-16T13:44:05.935636Z","submitted_at":"2024-06-11T16:42:02Z","title":"CTIBench: A Benchmark for Evaluating LLMs in Cyber Threat Intelligence","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07599","snapshot_observed_at":"2026-08-01T10:23:20.740447Z","title":"Ctibench: A benchmark for evaluating llms in cyber threat intelligence.arXiv preprint arXiv:2406.07599, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:20.740447Z"},"links":{"cited_paper":"/paper/2406.07599","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:f3921bb36a60da9b406a31359e4cd691ca8d99b42288479be0fd9d94578753f3","observation_id":"3073133f-b7f5-4a69-a307-ee116e01a7b7","resolution":{"observed_at":"2026-08-01T10:23:20.740447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03446","last_updated":"2024-06-03T04:04:52Z","snapshot_observed_at":"2026-08-16T13:55:03.387649Z","submitted_at":"2024-05-06T13:17:43Z","title":"SEvenLLM: Benchmarking, Eliciting, and Enhancing Abilities of Large Language Models in Cyber Threat Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03446","snapshot_observed_at":"2026-08-01T10:23:20.860851Z","title":"Sevenllm: Benchmarking, eliciting, and enhancing abilities of large language models in cyber threat intelligence.arXiv preprint arXiv:2405.03446, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:20.860851Z"},"links":{"cited_paper":"/paper/2405.03446","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:0edc4099c304d4c1dd4033b72693a2a3b7dedb8084c2c932e9c5c7df7b53bb15","observation_id":"96c80d3e-f825-4524-ac33-b764d2872f66","resolution":{"observed_at":"2026-08-01T10:23:20.860851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:20.957949Z","title":"Llms cannot reliably identify and reason about security vulnerabilities (yet?): A comprehensive evaluation, framework, and benchmarks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:20.957949Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:f087fb6a99ee4333183b7b3ed48878b801d70b5e1cc524207113f494882576f5","observation_id":"bf418c77-9d59-4d0f-b9de-4a874fd8c3ff","resolution":{"observed_at":"2026-08-01T10:23:20.957949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:21.085918Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:21.085918Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:7ce348eade61e234ed37eb867dc50c2d2a685ead2498240688d11659c0df1cc0","observation_id":"22a24b15-7c45-4e5d-b001-7f1a81b1e6b2","resolution":{"observed_at":"2026-08-01T10:23:21.085918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07688","last_updated":"2024-06-03T08:14:45Z","snapshot_observed_at":"2026-08-16T14:19:19.666029Z","submitted_at":"2024-02-12T14:53:28Z","title":"CyberMetric: A Benchmark Dataset based on Retrieval-Augmented Generation for Evaluating LLMs in Cybersecurity Knowledge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07688","snapshot_observed_at":"2026-08-01T10:23:21.194170Z","title":"Cyber- metric: A benchmark dataset based on retrieval-augmented generation for evaluating llms in cybersecurity knowledge.arXiv preprint arXiv:2402.07688, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:21.194170Z"},"links":{"cited_paper":"/paper/2402.07688","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:c10a3a1b719f7614dbbcb78af168ee32fdc43858e30c759c68d190a7a92c9796","observation_id":"a1347f63-ea6a-451e-ab4b-6f7f93fa301d","resolution":{"observed_at":"2026-08-01T10:23:21.194170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:21.313382Z","title":"vulnerable by design","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:21.313382Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:b4094678c83ab72bde8295c4cea11e8ac3faf6ab6a8ff36dbca0ded1c993bf6a","observation_id":"912932fe-38d3-41ad-9465-6c1a98707ffc","resolution":{"observed_at":"2026-08-01T10:23:21.313382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:21.415709Z","title":"Steampipe: Zero-etl sql for cloud, saas, and infrastructure apis.https://steampipe.io, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:21.415709Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:4aacc8bb755c46dd02dfb058e2f573d230b6e84d371fc9d2133e45500a9b2f61","observation_id":"ba41db4e-2e88-4b27-8c01-3e0a15cee851","resolution":{"observed_at":"2026-08-01T10:23:21.415709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:21.531996Z","title":"Cloudquery: Open-source cloud asset inventory.https://www.cloudquery.io, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:21.531996Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:d54e4d6be8b83a80c4df3706c8d0387382d59aae82121b7f3e719f78373d3569","observation_id":"ebd3eecb-62ec-44e1-b558-8239f655bdb4","resolution":{"observed_at":"2026-08-01T10:23:21.531996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:21.619124Z","title":"G-eval: Nlg evaluation using gpt-4 with better human alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:21.619124Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:3cd12de73b6decbb83db501aa20313675dc9650a50a45449468601ee11a71229","observation_id":"c02e645d-ef7c-4d96-bd9a-4342c88d0ffc","resolution":{"observed_at":"2026-08-01T10:23:21.619124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15217","last_updated":"2025-04-28T05:09:12Z","snapshot_observed_at":"2026-08-13T16:22:14.977210Z","submitted_at":"2023-09-26T19:23:54Z","title":"Ragas: Automated Evaluation of Retrieval Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15217","snapshot_observed_at":"2026-08-01T10:23:21.708925Z","title":"Ragas: Automated evaluation of retrieval augmented generation.arXiv preprint arXiv:2309.15217, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:21.708925Z"},"links":{"cited_paper":"/paper/2309.15217","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:b96fb78df1ea67ace12570cc04a7a3714892619f9f8d9c6251b10885a62fcd43","observation_id":"0c782df0-8808-4d01-9cac-90e3bf5f1060","resolution":{"observed_at":"2026-08-01T10:23:21.708925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15334","last_updated":"2023-05-24T16:48:11Z","snapshot_observed_at":"2026-08-14T14:07:14.900729Z","submitted_at":"2023-05-24T16:48:11Z","title":"Gorilla: Large Language Model Connected with Massive APIs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15334","snapshot_observed_at":"2026-08-01T10:23:21.815757Z","title":"Patil, Tianjun Zhang, Xin Wang, and Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:21.815757Z"},"links":{"cited_paper":"/paper/2305.15334","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:771e2fab8c59be0b98bb3edf235f19fdb05ec4339b6904ca9346c94af52d5c70","observation_id":"1beb868d-04e9-4425-9d05-1b36586793dc","resolution":{"observed_at":"2026-08-01T10:23:21.815757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:21.924895Z","title":"Api-bank: A comprehensive benchmark for tool-augmented llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:21.924895Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:1a245fdbd7eebcabbcbf002f0ace8adde8ab3a714efa546591d54019ecb96138","observation_id":"a0c877ed-43ab-40ad-b39e-2b9e499254bb","resolution":{"observed_at":"2026-08-01T10:23:21.924895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:22.007969Z","title":"Open cybersecurity schema framework (ocsf).https://ocsf.io, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:22.007969Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:0173c3a382056685a8f50955c5137ae210fcea9275beef38a091cb78a52f095a","observation_id":"db4fecc8-9e73-4d1e-846f-a63d74cc4685","resolution":{"observed_at":"2026-08-01T10:23:22.007969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:22.085108Z","title":"Amazon security lake.https://aws.amazon.com/security-lake/, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:22.085108Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:12676e3943187ff4e742a216ea30ee0bae33400bb264c27c219f23088f3d240a","observation_id":"022f9c73-846d-42ec-b666-d198379ed208","resolution":{"observed_at":"2026-08-01T10:23:22.085108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:22.177312Z","title":"Okta security best practices.https://help.okta.com/, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:22.177312Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:5786c6eaeffb70984761449f5d7b19e6c3d21ed93f95f07ef91bf6f01c8e5097","observation_id":"be9beeca-257c-446a-b963-74960ce8103f","resolution":{"observed_at":"2026-08-01T10:23:22.177312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:22.277528Z","title":"Security checklist for medium and large businesses (100+ users).https://support.google","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:22.277528Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:d139ee5a956d21c30cdc30a9d6b3ae5acdee86d781a791eca9a1b54f2c1b3397","observation_id":"3cdc62a7-4b77-4f6a-86b3-4261d297a572","resolution":{"observed_at":"2026-08-01T10:23:22.277528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:22.343249Z","title":"Bloodhound: Active directory and azure attack-path management.https://github.com/ SpecterOps/BloodHound, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:22.343249Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:2d1b25407be34024cc758fbd94acf467a32eb023d29bcf95e5ea191136786274","observation_id":"dfe98e99-cc2b-48cd-9d4d-94ce9ae09329","resolution":{"observed_at":"2026-08-01T10:23:22.343249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:22.408229Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:22.408229Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:9ee802ddcf63e453c20a7acc0ab9974a41cc3a5a2f5b11027336ec902ae288e7","observation_id":"44228d78-f938-416e-8dad-1a253153a56e","resolution":{"observed_at":"2026-08-01T10:23:22.408229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17926","last_updated":"2023-08-30T13:22:35Z","snapshot_observed_at":"2026-08-14T09:51:03.197404Z","submitted_at":"2023-05-29T07:41:03Z","title":"Large Language Models are not Fair Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17926","snapshot_observed_at":"2026-08-01T10:23:22.479202Z","title":"Large language models are not fair evaluators.arXiv preprint arXiv:2305.17926, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:22.479202Z"},"links":{"cited_paper":"/paper/2305.17926","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:fd90de7b60da0660a96daa75864e9b58177734d67c73c34ccd21643b099c7b8c","observation_id":"cff4e88b-53ff-4b27-9ded-88a0323cadc9","resolution":{"observed_at":"2026-08-01T10:23:22.479202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:22.546430Z","title":"Self-consistency improves chain of thought reasoning in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:22.546430Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:8c5cc46ba672f1e8eb4151bdbebd13adc750c382e8a8789e56c9d7e436e0cc41","observation_id":"0848230d-43f0-4388-bb1f-b03553d5a237","resolution":{"observed_at":"2026-08-01T10:23:22.546430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:22.608967Z","title":"A coefficient of agreement for nominal scales.Educational and Psychological Measurement, 20(1):37–46, 1960","venue":null,"work_id":null,"year":1960},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:22.608967Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:decde0c498b3b53790351257a6a4489da7de527fadbccd7ff629b9d2ed414f51","observation_id":"19f121cd-86eb-42ed-984c-3bbd3d469df8","resolution":{"observed_at":"2026-08-01T10:23:22.608967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:22.710491Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.Nature, 645:633–638, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:22.710491Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:a45c76a250fcd6a1ab04de147b4b5ff501c101171e6aa400da53a2c29cbbdbeb","observation_id":"d995c372-b1c2-4cb0-97eb-e3f78cecab06","resolution":{"observed_at":"2026-08-01T10:23:22.710491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-17T14:11:00.232598Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-01T10:23:22.765323Z","title":"Miranda, Alisa Liu, Nouha Dziri, Shane Lyu, Yuling Gu, Saumya Malik, Victoria Graf, Jena D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:22.765323Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:18c0e0de46d1f22cf5b15113d8c3e5a398f2759a9391c0edb7068f2445626a12","observation_id":"a1039ae7-7c0a-4d52-8749-a27157c3d48e","resolution":{"observed_at":"2026-08-01T10:23:22.765323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-01T10:23:22.830487Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:22.830487Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:3b24d593cd44130123a12dfebf90dc98523bd385d5e538a410ea9f74c5452109","observation_id":"ab040bbd-07c2-4dea-8241-2166fd8fa865","resolution":{"observed_at":"2026-08-01T10:23:22.830487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03741","last_updated":"2023-02-17T17:00:34Z","snapshot_observed_at":"2026-08-12T12:29:44.507445Z","submitted_at":"2017-06-12T17:23:59Z","title":"Deep reinforcement learning from human preferences","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03741","snapshot_observed_at":"2026-08-01T10:23:22.916039Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:22.916039Z"},"links":{"cited_paper":"/paper/1706.03741","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:4a2e04d5383f83c7cac82a8b46d15f51d5caa59753f8dcacf8555e12b089209a","observation_id":"b5c9031c-ad06-42fc-9e03-0f4097375edd","resolution":{"observed_at":"2026-08-01T10:23:22.916039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-01T10:23:22.982297Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems.arXiv preprint arXiv:2005.01643, 2020","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:22.982297Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:440047b7eae5161855a1f7c948b76df8adefeedc6d302d3345ddc6976c674a6d","observation_id":"8a5f6a2f-bcbc-4aa3-9fa3-07dd4a75598d","resolution":{"observed_at":"2026-08-01T10:23:22.982297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1011.0686","last_updated":"2011-03-16T18:51:21Z","snapshot_observed_at":"2026-08-15T05:04:07.152443Z","submitted_at":"2010-11-02T17:55:55Z","title":"A Reduction of Imitation Learning and Structured Prediction to No-Regret Online Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1011.0686","snapshot_observed_at":"2026-08-01T10:23:23.043807Z","title":"Gordon, and J","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:23.043807Z"},"links":{"cited_paper":"/paper/1011.0686","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:a2d378d6a2be8421040ddc09714d4c02b70dcdad65c5ee115c4ba4559202c221","observation_id":"6aab12ec-e19c-4b7b-8dba-0c04339806ad","resolution":{"observed_at":"2026-08-01T10:23:23.043807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14465","last_updated":"2022-05-20T13:52:54Z","snapshot_observed_at":"2026-08-16T17:11:25.867747Z","submitted_at":"2022-03-28T03:12:15Z","title":"STaR: Bootstrapping Reasoning With Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14465","snapshot_observed_at":"2026-08-01T10:23:23.080738Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:23.080738Z"},"links":{"cited_paper":"/paper/2203.14465","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:2e6b0adb0ea243f68cb9b3b5551cef8477d92212281c4ffe91f2e6ed11ef0862","observation_id":"d8115288-2739-4d6f-823e-a760abed4ec1","resolution":{"observed_at":"2026-08-01T10:23:23.080738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13351","last_updated":"2026-05-07T20:19:13Z","snapshot_observed_at":"2026-08-17T13:08:52.450705Z","submitted_at":"2025-06-16T10:43:38Z","title":"Direct Reasoning Optimization: Token-Level Reasoning Reflectivity Meets Rubric Gates for Unverifiable Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.13351","snapshot_observed_at":"2026-08-01T10:23:23.168854Z","title":"Direct reasoning optimization: Llms can reward and refine their own reasoning for open-ended tasks.arXiv preprint arXiv:2506.13351v1, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:23.168854Z"},"links":{"cited_paper":"/paper/2506.13351","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:d246cbc554dce1613a0f406c6fdf39bfdd3d47dca099a66586c80f302a2b8836","observation_id":"f2777606-e344-481d-91d4-74dea9cbc06a","resolution":{"observed_at":"2026-08-01T10:23:23.168854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:23.244977Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:23.244977Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:ad2f00bc4ba343ac68197df9d15cc4106b66c24c09f64b0bfd752775e905c1ca","observation_id":"82f3bb05-fc99-46fd-a3c1-128d89563593","resolution":{"observed_at":"2026-08-01T10:23:23.244977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00537","last_updated":"2020-02-13T00:28:00Z","snapshot_observed_at":"2026-08-17T22:08:45.245439Z","submitted_at":"2019-05-02T00:41:50Z","title":"SuperGLUE: A Stickier Benchmark for General-Purpose Language Understanding Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.00537","snapshot_observed_at":"2026-08-01T10:23:23.317414Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:23.317414Z"},"links":{"cited_paper":"/paper/1905.00537","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:ebd4f31f7dbf01992f3a8e563751547528c45b3d30d8b4bc6c4b7c5cf220e219","observation_id":"83c61e55-6e1d-4bfe-aca8-2d30eaf4c06c","resolution":{"observed_at":"2026-08-01T10:23:23.317414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-08-18T08:11:45.716032Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-01T10:23:23.368813Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:23.368813Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:659b44ad8c49cce1ab4329f4bbfa9c6d634c5005db66e07d5dc6c46e6b1777d6","observation_id":"33f504aa-d9c1-46c5-9d5f-026798e8cc2a","resolution":{"observed_at":"2026-08-01T10:23:23.368813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:23:23.447306Z","title":"Sheridan, and Christopher D","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T10:23:23.447306Z"},"links":{"citing_paper":"/paper/2607.27288"},"observation_digest":"sha256:3a4ae9e1d0a5ac3a03c93c4db837276f274c146f3205388e3f4fc4ea8a43e303","observation_id":"bdb5fbfc-bc0d-4b73-9a1d-fac745e2be0c","resolution":{"observed_at":"2026-08-01T10:23:23.447306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.27288","last_updated":"2026-07-29T14:46:04Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-17T03:28:20.887720Z","submitted_at":"2026-07-29T14:46:04Z","title":"Open Security Benchmark: Towards Autonomous Enterprise Cyber Defense"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":67,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2607.27288."}