{"as_of":"2026-08-08T03:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:564a5baafb53b581cfe3d3f85b32b10ac35b01199be59eaa5f7181322967bbaa","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T14:43:00.540074Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T04:42:49.379223Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T06:01:22.935133Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"cited_work":{"arxiv_id":"2509.23571","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.23571","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Benchmarking llm-assisted blue teaming via standardized threat hunting","venue":null,"work_id":"ca8e579b-75b7-4702-bcda-3107ebe67305","year":2025},"citing_paper":{"arxiv_id":"2605.09330","last_updated":"2026-05-10T05:04:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-10T05:04:13Z","title":"The Trap of Trajectory: Towards Understanding and Mitigating Spurious Correlations in Agentic Memory","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:49.379223Z"},"links":{"cited_paper":"/paper/2509.23571","citing_paper":"/paper/2605.09330"},"observation_digest":"sha256:92a898c59de49e0bb1abc404d74c53962e484bc7808349dc2bf0bf4aa5589505","observation_id":"fadfd38b-f307-4367-a530-2dee41952e18","resolution":{"observed_at":"2026-05-29T02:04:56.816440Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.23571/citation-record","integrity":"/paper/2509.23571/integrity","json":"/paper/2509.23571/citation-record.json","paper":"/paper/2509.23571"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.07587","last_updated":"2024-09-11T19:33:44Z","snapshot_observed_at":"2026-07-06T19:13:59.780393Z","submitted_at":"2024-09-11T19:33:44Z","title":"Exploring LLMs for Malware Detection: Review, Framework Design, and Countermeasure Approaches","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07587","snapshot_observed_at":"2026-08-04T14:42:55.997378Z","title":"Exploring llms for mal- ware detection: Review, framework design, and countermeasure approaches.arXiv preprint arXiv:2409.07587,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:55.997378Z"},"links":{"cited_paper":"/paper/2409.07587","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:58039df255591100b02064510d14c20e15e2c3c05db8f5f5da551d7fe559399a","observation_id":"ed287650-8aae-4599-8832-05804fc4637c","resolution":{"observed_at":"2026-08-04T14:42:55.997378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:00.300356Z","title":"Recent activity by APT29 involving phishing attacks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:00.300356Z"},"links":{"citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:5752e9ed144984956bbf42f3338680fb3039c8f654efb810acfcc8f6c3ef60a8","observation_id":"879a5909-2399-4b79-aa26-cb68a5cbd7b9","resolution":{"observed_at":"2026-08-04T14:43:00.300356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06782","last_updated":"2024-06-02T16:16:49Z","snapshot_observed_at":"2026-08-07T16:46:33.307475Z","submitted_at":"2023-08-13T14:35:50Z","title":"PentestGPT: An LLM-empowered Automatic Penetration Testing Tool","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06782","snapshot_observed_at":"2026-08-04T14:42:56.442650Z","title":"Pentestgpt: An llm-empowered automatic penetration testing tool.arXiv preprint arXiv:2308.06782,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:56.442650Z"},"links":{"cited_paper":"/paper/2308.06782","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:8ed9cc8991b4df69f81b4d8f18b3a047bd9bcd551fb870808234e62b32e1988f","observation_id":"76eeb581-2705-45ad-9a38-86094e7e1a23","resolution":{"observed_at":"2026-08-04T14:42:56.442650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:00.368756Z","title":"Given a vulnerability description and metric values (Confidentiality, Integrity, Availability, Scope, Attack Vector, etc.), compute the CVSS v3.1 Base Score","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:00.368756Z"},"links":{"citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:705e846dd40bc79d12977d2fc80e04eddf818ecfe71985ef13cd9cf1e448deb3","observation_id":"c843c349-e698-40e1-83e5-a2563f7cc3cf","resolution":{"observed_at":"2026-08-04T14:43:00.368756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16289","last_updated":"2023-09-28T09:35:59Z","snapshot_observed_at":"2026-08-07T18:48:25.719201Z","submitted_at":"2023-09-28T09:35:59Z","title":"LawBench: Benchmarking Legal Knowledge of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16289","snapshot_observed_at":"2026-08-04T14:42:56.728972Z","title":"Lawbench: Benchmarking legal knowledge of large language models.arXiv preprint arXiv:2309.16289,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:56.728972Z"},"links":{"cited_paper":"/paper/2309.16289","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:3cedb85a150d2ba16050f0c79d615ff7b469601e0986b4ff8989bcffd620ed5a","observation_id":"73607cfe-56a0-4dad-bcf7-da49325fa311","resolution":{"observed_at":"2026-08-04T14:42:56.728972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:42:56.871031Z","title":"Getting pwn’d by ai: Penetration testing with large language models","venue":null,"work_id":null,"year":2082},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:56.871031Z"},"links":{"citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:d8328076b3eda109ee9f2ff2d600a67a8accf90d7ca3555ae84ad8ee2de97f16","observation_id":"ff3934ee-a634-4147-8c59-bf63a2da6dad","resolution":{"observed_at":"2026-08-04T14:42:56.871031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00533","last_updated":"2021-02-10T16:59:20Z","snapshot_observed_at":"2026-08-04T03:14:35.997862Z","submitted_at":"2020-10-01T16:31:46Z","title":"Linking Threat Tactics, Techniques, and Patterns with Defensive Weaknesses, Vulnerabilities and Affected Platform Configurations for Cyber Hunting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00533","snapshot_observed_at":"2026-08-04T14:42:57.074742Z","title":"Linking threat tactics, techniques, and patterns with defensive weaknesses, vulnerabilities and affected platform configurations for cyber hunting.arXiv preprint arXiv:2010.00533,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:57.074742Z"},"links":{"cited_paper":"/paper/2010.00533","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:a66f68bc34ef12927c3e90a4f50dc48ba6790821f5f372cdc0b2312802fea5af","observation_id":"3479835f-b7dc-4ee1-915f-dd801fba241d","resolution":{"observed_at":"2026-08-04T14:42:57.074742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18567","last_updated":"2025-03-07T00:46:35Z","snapshot_observed_at":"2026-08-04T18:56:15.665516Z","submitted_at":"2024-04-29T10:14:58Z","title":"Double Backdoored: Converting Code Large Language Model Backdoors to Traditional Malware via Adversarial Instruction Tuning Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18567","snapshot_observed_at":"2026-08-04T14:42:57.277985Z","title":"Assessing cybersecurity vulnerabilities in code large language models.arXiv preprint arXiv:2404.18567,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:57.277985Z"},"links":{"cited_paper":"/paper/2404.18567","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:05ec967683927e4fddbc497f24e88c54d32aa261ab7b317901ad8f9130c34062","observation_id":"86b985b7-1372-49a6-9559-b40879ee6b34","resolution":{"observed_at":"2026-08-04T14:42:57.277985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00764","last_updated":"2025-02-06T09:17:39Z","snapshot_observed_at":"2026-08-05T14:07:44.708303Z","submitted_at":"2024-08-01T17:59:46Z","title":"AgentGen: Enhancing Planning Abilities for Large Language Model based Agent via Environment and Task Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00764","snapshot_observed_at":"2026-08-04T14:42:57.447644Z","title":"Agentgen: Enhancing planning abilities for large language model based agent via environment and task generation.arXiv preprint arXiv:2408.00764,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:57.447644Z"},"links":{"cited_paper":"/paper/2408.00764","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:a789a867d842d6dddad5a1d570d2e9588a39f37e84d248ec9ba2e20fde7f1979","observation_id":"a74e8a31-41a2-46ee-b059-42dd4d490b5e","resolution":{"observed_at":"2026-08-04T14:42:57.447644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03446","last_updated":"2024-06-03T04:04:52Z","snapshot_observed_at":"2026-07-06T18:10:25.347780Z","submitted_at":"2024-05-06T13:17:43Z","title":"SEvenLLM: Benchmarking, Eliciting, and Enhancing Abilities of Large Language Models in Cyber Threat Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03446","snapshot_observed_at":"2026-08-04T14:42:57.638474Z","title":"Sevenllm: Benchmarking, eliciting, and enhancing abilities of large language models in cyber threat intelligence.arXiv preprint arXiv:2405.03446,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:57.638474Z"},"links":{"cited_paper":"/paper/2405.03446","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:f74468c038ed5f82c7a8af64de94a18291a94ada400d19232fa9f2f2c18c2fe7","observation_id":"f0a9743d-324b-46dd-9305-bad0f4975483","resolution":{"observed_at":"2026-08-04T14:42:57.638474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-04T14:42:57.860062Z","title":"Swe-bench: Can language models resolve real-world github issues?arXiv preprint arXiv:2310.06770,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:57.860062Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:b3b486d80c305639dc7e818acb28eeb46c0a7448fe2370c61cafa8216e78e219","observation_id":"f0696039-ceff-457a-b349-8a9394cff6ca","resolution":{"observed_at":"2026-08-04T14:42:57.860062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20361","last_updated":"2025-05-24T06:22:42Z","snapshot_observed_at":"2026-08-01T16:12:20.328056Z","submitted_at":"2024-07-29T18:21:34Z","title":"From ML to LLM: Evaluating the Robustness of Phishing Webpage Detection Models against Adversarial Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20361","snapshot_observed_at":"2026-08-04T14:42:58.029258Z","title":"From ml to llm: Evaluating the robustness of phishing webpage detection models against adversarial attacks.arXiv preprint arXiv:2407.20361,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:58.029258Z"},"links":{"cited_paper":"/paper/2407.20361","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:6802fb142f9e68a73b35cb297d3644285aa7fb4fe2d07b9c7b74eddcfcdef513","observation_id":"74321f04-6cec-4cf2-bdbb-52392101377d","resolution":{"observed_at":"2026-08-04T14:42:58.029258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:42:58.251543Z","title":"Mary M Lucas, Justin Yang, Jon K Pomeroy, and Christopher C Yang","venue":null,"work_id":null,"year":1964},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:58.251543Z"},"links":{"citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:dc52b2286fd38e896c0a84c2775b1736ea3df09fd9035bcc5ae58188cfc5dc89","observation_id":"afcbea36-528e-46c1-a069-673915217a58","resolution":{"observed_at":"2026-08-04T14:42:58.251543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:42:58.347252Z","title":"John Morris, Eli Lifland, Jin Yong Yoo, Jake Grigsby, Di Jin, and Yanjun Qi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:58.347252Z"},"links":{"citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:92ebe8d0eef4ce4646bd3ae126a087234bc845a18bc224fdcbd08282c91c5ac8","observation_id":"1deb6f73-04d7-4ccd-8be9-d519bfa4a402","resolution":{"observed_at":"2026-08-04T14:42:58.347252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15852","last_updated":"2024-03-15T21:04:34Z","snapshot_observed_at":"2026-07-06T15:33:11.344191Z","submitted_at":"2023-05-25T08:43:46Z","title":"Self-contradictory Hallucinations of Large Language Models: Evaluation, Detection and Mitigation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15852","snapshot_observed_at":"2026-08-04T14:42:58.510053Z","title":"Self-contradictory hallucinations of large language models: Evaluation, detection and mitigation.arXiv preprint arXiv:2305.15852,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:58.510053Z"},"links":{"cited_paper":"/paper/2305.15852","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:f40ce2085c95a2e1208d692960cd179f3fdf8823e13fef9087d3fd0401082530","observation_id":"84e9fd00-88f7-4d68-9944-69a8ba80a76d","resolution":{"observed_at":"2026-08-04T14:42:58.510053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01778","last_updated":"2024-12-02T18:28:18Z","snapshot_observed_at":"2026-07-06T20:00:23.632792Z","submitted_at":"2024-12-02T18:28:18Z","title":"HackSynth: LLM Agent and Evaluation Framework for Autonomous Penetration Testing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01778","snapshot_observed_at":"2026-08-04T14:42:58.660386Z","title":"Hacksynth: Llm agent and evaluation framework for autonomous penetration testing.arXiv preprint arXiv:2412.01778,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:58.660386Z"},"links":{"cited_paper":"/paper/2412.01778","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:24c6fc4e30e3260e312591cab3eebacba95766a537abc8d634644d316496988e","observation_id":"56861ea8-a6ca-447d-b970-86941d6a8b75","resolution":{"observed_at":"2026-08-04T14:42:58.660386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13055","last_updated":"2025-04-21T18:09:35Z","snapshot_observed_at":"2026-08-07T18:07:46.040987Z","submitted_at":"2025-02-18T17:01:37Z","title":"LAMD: Context-driven Android Malware Detection and Classification with LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13055","snapshot_observed_at":"2026-08-04T14:42:58.798445Z","title":"Lamd: Context-driven android malware detection and classification with llms.arXiv preprint arXiv:2502.13055,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:58.798445Z"},"links":{"cited_paper":"/paper/2502.13055","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:ae42ae2ca793c342d66109978506391f217b42ec1687d1d05de8c3785a9657d2","observation_id":"3540c3ce-97a8-4aa0-b976-37c5f23aec20","resolution":{"observed_at":"2026-08-04T14:42:58.798445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05185","last_updated":"2025-05-29T23:48:08Z","snapshot_observed_at":"2026-08-06T16:57:23.523813Z","submitted_at":"2024-11-07T21:10:39Z","title":"PentestAgent: Incorporating LLM Agents to Automated Penetration Testing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05185","snapshot_observed_at":"2026-08-04T14:42:59.126030Z","title":"Pentestagent: Incorporating llm agents to automated penetration testing.arXiv preprint arXiv:2411.05185,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:59.126030Z"},"links":{"cited_paper":"/paper/2411.05185","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:ac8b9b641c55cd2b317749652a5def4b685030833cb829b56b5eb11a8cbcb166","observation_id":"822c3d1c-f698-4902-be20-5fe59bf02018","resolution":{"observed_at":"2026-08-04T14:42:59.126030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06493","last_updated":"2024-11-14T05:34:13Z","snapshot_observed_at":"2026-08-03T14:32:46.405921Z","submitted_at":"2024-11-10T15:21:30Z","title":"LProtector: An LLM-driven Vulnerability Detection System","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06493","snapshot_observed_at":"2026-08-04T14:42:59.281707Z","title":"Lprotector: An llm-driven vulnerability detection system.arXiv preprint arXiv:2411.06493,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:59.281707Z"},"links":{"cited_paper":"/paper/2411.06493","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:77ebeeaca7b0f17e77ef9b42a56f047416a670a6c194519cb3f516bcab576e66","observation_id":"181ddbef-3acf-404c-a71e-400fc87569da","resolution":{"observed_at":"2026-08-04T14:42:59.281707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12964","last_updated":"2025-08-25T16:47:29Z","snapshot_observed_at":"2026-08-07T18:08:05.452423Z","submitted_at":"2025-02-18T15:46:31Z","title":"Trust Me, I'm Wrong: LLMs Hallucinate with Certainty Despite Knowing the Answer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12964","snapshot_observed_at":"2026-08-04T14:42:59.437743Z","title":"Response inconsistency of large language models in high-stakes military decision making","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:59.437743Z"},"links":{"cited_paper":"/paper/2502.12964","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:64ece5bea2509ce9bd1c3150b97cd69be05cc8b2c25eb415c6c4898d089565e9","observation_id":"fc089923-f062-4713-9b86-731138440fd7","resolution":{"observed_at":"2026-08-04T14:42:59.437743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10001","last_updated":"2023-06-01T05:38:00Z","snapshot_observed_at":"2026-08-07T18:44:16.941060Z","submitted_at":"2022-12-20T05:20:54Z","title":"Towards Understanding Chain-of-Thought Prompting: An Empirical Study of What Matters","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10001","snapshot_observed_at":"2026-08-04T14:42:59.598970Z","title":"Boshi Wang, Sewon Min, Xiang Deng, Jiaming Shen, You Wu, Luke Zettlemoyer, and Huan Sun","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:59.598970Z"},"links":{"cited_paper":"/paper/2212.10001","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:237aa7e38c4f04363cf4a1a3cc037749c8b7b8bb917075b9b42f471fa0208a8e","observation_id":"24a463b9-bcb9-479c-9c74-10d3354b88aa","resolution":{"observed_at":"2026-08-04T14:42:59.598970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04959","last_updated":"2023-10-08T01:16:55Z","snapshot_observed_at":"2026-07-06T16:29:15.947222Z","submitted_at":"2023-10-08T01:16:55Z","title":"Towards Better Chain-of-Thought Prompting Strategies: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04959","snapshot_observed_at":"2026-08-04T14:42:59.770384Z","title":"Towards better chain-of-thought prompting strategies: A survey.arXiv preprint arXiv:2310.04959,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:59.770384Z"},"links":{"cited_paper":"/paper/2310.04959","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:2a14e6c751d212b47bcd8f81f02f07864555e0cc435481f5b974dade59ae94e6","observation_id":"97b00db1-7dc6-49d9-8677-e69b0a1ddb9f","resolution":{"observed_at":"2026-08-04T14:42:59.770384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-04T14:42:59.893756Z","title":"Official implementation: https: //github.com/Tiiiger/bert_score","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:59.893756Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:03dae0bd23c5c151fd2ed4597ff593755aba0b1a993b89563af5a06caba26a8b","observation_id":"de27c9e2-631d-4ce6-92fc-0ad621c483f7","resolution":{"observed_at":"2026-08-04T14:42:59.893756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:00.068603Z","title":"Each CVE entry is enriched with exploitability status, malware connections, and actor attribution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:00.068603Z"},"links":{"citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:4736d1da604d0527634544dbcb982952f911e1f9200ae49296ba122afff122dd","observation_id":"cf5585ba-a656-413d-a23f-c5741f87fc15","resolution":{"observed_at":"2026-08-04T14:43:00.068603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:00.190538Z","title":"Entries often include exploitability scores, attack vectors, exploitation status, and tags related to malware or campaigns","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:00.190538Z"},"links":{"citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:f38d1e759cee1d65773fe903623be480ec860763d17de6947029f7eff356aec4","observation_id":"d1cfb6ad-fc9c-41ea-93df-b837e26610b4","resolution":{"observed_at":"2026-08-04T14:43:00.190538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:00.540074Z","title":"\\n\", \"Q:","venue":null,"work_id":null,"year":2048},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:00.540074Z"},"links":{"citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:55bb652e003ccda3321fc9f036a4e0fb7656060c93595ba650a8f4d260bf76d1","observation_id":"713946d3-1953-4df6-bfb2-9bbf9ac0e35d","resolution":{"observed_at":"2026-08-04T14:43:00.540074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11858","last_updated":"2025-04-11T04:26:42Z","snapshot_observed_at":"2026-08-07T22:40:18.806054Z","submitted_at":"2025-01-21T03:22:10Z","title":"EmbodiedEval: Evaluate Multimodal LLMs as Embodied Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11858","snapshot_observed_at":"2026-08-04T14:42:56.148795Z","title":"Embodiedeval: Evaluate multimodal llms as embodied agents.arXiv preprint arXiv:2501.11858,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:56.148795Z"},"links":{"cited_paper":"/paper/2501.11858","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:aad816ca614b56e89173203a7f8b66591842d1863c4c88971d5eda8e7154f8c9","observation_id":"8b7d6512-f21c-434b-a8e0-1e0f7890470d","resolution":{"observed_at":"2026-08-04T14:42:56.148795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-04T14:42:56.514657Z","title":"A survey on in-context learning.arXiv preprint arXiv:2301.00234,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:56.514657Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:a9fc24b2468ead3cd5b2c3b56f91443929fa533e33d20754d974e3d51ea8c415","observation_id":"25fa5b4f-dfe7-49d1-8644-beaec5f741f1","resolution":{"observed_at":"2026-08-04T14:42:56.514657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16607","last_updated":"2024-12-21T12:43:52Z","snapshot_observed_at":"2026-07-31T02:08:00.927302Z","submitted_at":"2024-12-21T12:43:52Z","title":"Improving Discovery of Known Software Vulnerability For Enhanced Cybersecurity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16607","snapshot_observed_at":"2026-08-04T14:42:58.909486Z","title":"Improving discovery of known software vulnerability for enhanced cybersecurity.arXiv preprint arXiv:2412.16607,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:58.909486Z"},"links":{"cited_paper":"/paper/2412.16607","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:31f810080b800d01ebd41443340fe449f128db48ab11019cad868d16e289ab21","observation_id":"57876458-b78d-4858-a0d9-49f8537d52c8","resolution":{"observed_at":"2026-08-04T14:42:58.909486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:42:57.173909Z","title":"Turning the hunted into the hunter via threat hunting: Life cycle, ecosystem, challenges and the great promise of ai.arXiv preprint arXiv:2204.11076,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:57.173909Z"},"links":{"citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:cb8b89e97eeae0f73762c9509427630f4fa6559d4ce5ae36096bef5b5975311c","observation_id":"2f3222c0-e045-4213-a748-ff069c3b7153","resolution":{"observed_at":"2026-08-04T14:42:57.173909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11501","last_updated":"2020-09-24T06:04:56Z","snapshot_observed_at":"2026-07-06T09:58:19.547859Z","submitted_at":"2020-09-24T06:04:56Z","title":"ThreatZoom: CVE2CWE using Hierarchical Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11501","snapshot_observed_at":"2026-08-04T14:42:55.916346Z","title":"Threatzoom: Cve2cwe using hierarchical neural network.arXiv preprint arXiv:2009.11501,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:55.916346Z"},"links":{"cited_paper":"/paper/2009.11501","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:524d1a8bf63cae4f09974ad96db0e0cde5f48e59a1709edbb56b8190cec91aa7","observation_id":"9ccc2245-e5a5-4540-bb65-45706cfcee4b","resolution":{"observed_at":"2026-08-04T14:42:55.916346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00927","last_updated":"2025-04-19T15:43:36Z","snapshot_observed_at":"2026-08-04T03:00:55.235335Z","submitted_at":"2024-11-01T15:57:45Z","title":"ReSpAct: Harmonizing Reasoning, Speaking, and Acting Towards Building Large Language Model-Based Conversational AI Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00927","snapshot_observed_at":"2026-08-04T14:42:56.627111Z","title":"Respact: Harmonizing reasoning, speaking, and acting towards building large language model-based conversational ai agents.arXiv preprint arXiv:2411.00927,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:56.627111Z"},"links":{"cited_paper":"/paper/2411.00927","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:3abee11555ae5020f001c23745dc5290d092808fbaca2924719a22a183f07971","observation_id":"c3d143e5-2835-4012-a3a8-43833b7994f0","resolution":{"observed_at":"2026-08-04T14:42:56.627111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.01822","last_updated":"2019-09-03T15:49:35Z","snapshot_observed_at":"2026-08-05T18:18:11.812559Z","submitted_at":"2019-09-03T15:49:35Z","title":"Frameworks for Querying Databases Using Natural Language: A Literature Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.01822","snapshot_observed_at":"2026-08-04T14:42:56.347322Z","title":"Frameworks for querying databases using natural language: a literature review.arXiv preprint arXiv:1909.01822,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:56.347322Z"},"links":{"cited_paper":"/paper/1909.01822","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:a74e94f0e4b5ba44bb9bfbeddff815c6aa8797d8b40f4e8a481e9b853785ff3b","observation_id":"b3979bdf-9f6e-4b69-b65c-3e4e97cb0781","resolution":{"observed_at":"2026-08-04T14:42:56.347322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07599","last_updated":"2024-11-11T12:00:35Z","snapshot_observed_at":"2026-07-06T18:29:08.586253Z","submitted_at":"2024-06-11T16:42:02Z","title":"CTIBench: A Benchmark for Evaluating LLMs in Cyber Threat Intelligence","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07599","snapshot_observed_at":"2026-08-04T14:42:56.064442Z","title":"Ctibench: A benchmark for evaluating llms in cyber threat intelligence.arXiv preprint arXiv:2406.07599,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:56.064442Z"},"links":{"cited_paper":"/paper/2406.07599","citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:3f05e31f82662dab46aab6c765f7db55d7bffe6d84c45cf95ecab0d242392295","observation_id":"084bd0b0-62d6-400c-bd10-d6b3261f90af","resolution":{"observed_at":"2026-08-04T14:42:56.064442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:42:56.259736Z","title":"Leshem Choshen, Ariel Gera, Yotam Perlitz, Michal Shmueli-Scheuer, and Gabriel Stanovsky","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:56.259736Z"},"links":{"citing_paper":"/paper/2509.23571"},"observation_digest":"sha256:af1e46b4df50360d3a362cc481f511a9a09b946124e7d96b391be40eeeb38108","observation_id":"0150a05d-0931-4a38-aa7d-b870dc710369","resolution":{"observed_at":"2026-08-04T14:42:56.259736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.23571","last_updated":"2026-05-28T01:23:06Z","latest_version":3,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-04T14:42:48.946226Z","submitted_at":"2025-09-28T02:08:17Z","title":"Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2509.23571."}