{"as_of":"2026-08-04T04:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:63c46d178aa25d05f488597bd7272e635a3fe63a0689d48adfb0eeceba347c95","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-11T01:54:46.391345Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.07830/citation-record","integrity":"/paper/2605.07830/integrity","json":"/paper/2605.07830/citation-record.json","paper":"/paper/2605.07830"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Claude-opus-4-5overview","venue":null,"work_id":"fb71d252-4bc1-44ec-a6ee-2bb28bbfa993","year":2025},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:f1e1a37d655a02776bf4699010df564cb898083845ed6b1c378b6a897a02bd30","observation_id":"c24baf1d-d848-4afb-a1cb-d373d01b746f","resolution":{"observed_at":"2026-05-14T15:11:37.456739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13161","last_updated":"2024-04-19T20:11:12Z","snapshot_observed_at":"2026-07-06T18:02:53.240463Z","submitted_at":"2024-04-19T20:11:12Z","title":"CyberSecEval 2: A Wide-Ranging Cybersecurity Evaluation Suite for Large Language Models","version":1},"cited_work":{"arxiv_id":"2404.13161","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.13161","snapshot_observed_at":"2026-07-08T23:05:44.229651Z","title":"CyberSecEval 2: A wide-ranging cybersecurity evaluation suite for large language models","venue":"cs.CR","work_id":"78dcbaa4-90bc-418c-a587-f93dcd7b9c85","year":2024},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"cited_paper":"/paper/2404.13161","citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:df65bc9d5b917a3f7bc47a654fad6a7d6c3f79f5fb838aeed92954d593c8a1cc","observation_id":"7d672f50-8c6f-48e3-b0e8-e9d296c8b777","resolution":{"observed_at":"2026-05-11T04:10:57.358908Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"{PentestGPT}: Evaluating and harnessing large language models for automated penetration testing","venue":null,"work_id":"7a3c85ed-747c-4af4-84d6-d0dcb448fb20","year":2024},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:0de0c3ec37cc962bc8f8c0a1f25b4d8a671760387bf9efa092840aa17454e386","observation_id":"ff3dc27c-27d5-43b3-a95c-895286f3c217","resolution":{"observed_at":"2026-05-14T15:11:37.453108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cognitive bias in decision-making with llms","venue":null,"work_id":"45d5db22-373c-4254-9d9b-b7cde464972b","year":2024},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:305ed61aa6d4cff222990b7a488f282a9b0e0df88c206301c21f8e12560e2e00","observation_id":"554ed952-3b6e-4162-9a37-257d1a7a1644","resolution":{"observed_at":"2026-05-14T15:11:37.454885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08144","last_updated":"2024-04-17T04:34:39Z","snapshot_observed_at":"2026-08-02T04:29:28.130280Z","submitted_at":"2024-04-11T22:07:19Z","title":"LLM Agents can Autonomously Exploit One-day Vulnerabilities","version":2},"cited_work":{"arxiv_id":"2404.08144","doi":"10.48550/arxiv.2404.08144","metadata_source":"pith","pith_arxiv_id":"2404.08144","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"LLM Agents can Autonomously Exploit One-day Vulnerabilities","venue":"cs.CR","work_id":"a9db82c2-9422-483d-9f38-2716700986a1","year":2024},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"cited_paper":"/paper/2404.08144","citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:5737cf09afeee8b790cbe60ab19dcc31443783b481bad868bec50902b5a419b8","observation_id":"e8af6451-2ddd-4bdd-bd6d-caf5caa9f20a","resolution":{"observed_at":"2026-05-18T04:18:27.783675Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemini API overview","venue":null,"work_id":"dd7b696a-d60e-4c61-90db-7137565b93dd","year":2026},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:4e148c0b4fbf866da5136ef1ad3e41bef68142e443a16a48c8ac8d51f3b7f043","observation_id":"06ec3b40-e457-4a05-82dc-07063da3a2c9","resolution":{"observed_at":"2026-05-14T15:11:37.437711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07987","last_updated":"2024-07-25T09:33:50Z","snapshot_observed_at":"2026-08-01T15:05:23.324854Z","submitted_at":"2024-05-13T17:58:30Z","title":"The Platonic Representation Hypothesis","version":5},"cited_work":{"arxiv_id":"2405.07987","doi":"10.48550/arxiv.2405.07987","metadata_source":"pith","pith_arxiv_id":"2405.07987","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"The Platonic Representation Hypothesis","venue":"cs.LG","work_id":"950baa06-36a7-4010-a959-7304fb1ce08b","year":2024},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"cited_paper":"/paper/2405.07987","citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:e1c20d176d0378fd3fe6f1d729ce8db17f8b99b48a822e94f4096cd4b446483d","observation_id":"52e37b0f-0a15-4402-b5b4-1676ae64f8be","resolution":{"observed_at":"2026-05-11T04:10:57.336349Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":"2310.06770","doi":"10.1145/512927.512945","metadata_source":"pith","pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","venue":"cs.CL","work_id":"d0effe15-a689-441a-8e3f-ea35f1c4e4b1","year":2023},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:afe6c5a880f4f81ede2de894ddca7861b49cdd6beded672f2efb97d3b92d3bbd","observation_id":"912e9609-892f-485b-992f-85f40fc531e0","resolution":{"observed_at":"2026-05-11T04:10:57.311376Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Benchmarking cognitive biases in large language models as evaluators","venue":null,"work_id":"496b7ed7-049b-4c83-a7ba-72d3b3e2451a","year":2024},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:6bf3af06b7efe627d889b3a0983f75bb8a7043cbf8399ffd49d04a69398015be","observation_id":"40a22270-d25e-408a-a1a9-8f86cfe5a789","resolution":{"observed_at":"2026-05-14T15:11:37.433105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Your ai, not your view: The bias of llms in investment analysis","venue":null,"work_id":"35f5c474-a238-4102-b415-7e851beff65e","year":2025},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:908b10b4981a9cbe0d59dd87ec4504c3243990682d4b13ba2ede771dc8c971d4","observation_id":"94addfab-558c-4ae8-b016-5c4061fa30cd","resolution":{"observed_at":"2026-05-14T15:11:37.451229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/18.61115","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T15:31:16.397389Z","title":"1991 , publisher =","venue":"IEEE Transactions on Information Theory","work_id":"e37e179c-3cc3-4939-a89a-dfaa9a44e137","year":1991},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:b58b5649d29dea05874e332172242327d13b7a6db244035dae27581fc734fa6d","observation_id":"8b279bce-b980-4861-8ddc-a04628d4bc28","resolution":{"observed_at":"2026-05-11T01:55:51.092292Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:07.036802+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:07.036802+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-07-06T16:03:30.529010Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":"2308.03688","doi":"10.1109/fllm63129.2024.10852426","metadata_source":"pith","pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"AgentBench: Evaluating LLMs as Agents","venue":"cs.AI","work_id":"a37549b4-4c94-412d-acc4-4efeb08509be","year":2023},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:9a6a2cf099594402d9ad5209fa3b4a66de2115e47aeda7c04ef6b400ff4bb67e","observation_id":"b6a6611d-386e-4a39-b611-59aea4d0c491","resolution":{"observed_at":"2026-05-11T11:40:05.312349Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.554295Z","title":"Agentboard: An analytical evaluation board of multi-turn llm agents.Advances in neural information processing systems, 37:74325–74362","venue":null,"work_id":"d63a8df5-0d2a-4c2d-b1b2-64ae703c9083","year":2024},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:8aa9415f9e3d835f35ba1351fa12cc586baf1cdbb72116c7cd913cf2ac250f7f","observation_id":"51820cb8-8a26-46d0-a2ea-e4b24bc23b63","resolution":{"observed_at":"2026-05-14T15:11:37.439962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:45:00.500366Z","title":null,"venue":null,"work_id":"5aa091d4-7487-47b5-82f0-297e266d27b4","year":2022},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:94186ee7d7ac72372e0e1260df355e315461a102741745a74bb13ba30f714a74","observation_id":"813114a9-d494-4e4f-a393-8377afb91939","resolution":{"observed_at":"2026-05-14T15:11:37.447607Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Common attack pattern enumeration and classification (capec)","venue":null,"work_id":"38f3d927-c666-41f8-acf3-8707de33d52a","year":null},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:1e52120a78f741133fc0fe9182538559011886094e5645d4f15017fd2eacc6ab","observation_id":"fa6049ec-a473-4ce9-97eb-dbfb0d1640bd","resolution":{"observed_at":"2026-05-14T15:11:37.449404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Common weakness enumeration (cwe)","venue":null,"work_id":"8e53d8ee-e3e2-4b68-b790-101c0079f5ad","year":null},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:4df687b548dc365c2a4f597309b401e49b3f3d53a9478c0aa2509802428a11a0","observation_id":"0cc314a1-63bf-4073-88e5-3f9ea27f8732","resolution":{"observed_at":"2026-05-14T15:11:37.443941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing GPT-5.2 codex","venue":null,"work_id":"ca2b8fd7-e0f7-4554-8c50-654be4caf1bb","year":2025},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:1088dab96f46d45ca27b0644d5ac8273a03d76cd13a6f5ad84857e8db76e8b9f","observation_id":"c1974f97-acfd-4144-b1f0-c1d8d3678571","resolution":{"observed_at":"2026-05-14T15:11:37.445888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T18:16:26.555721Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744","venue":null,"work_id":"aa3e2ba7-4265-495b-8612-615b2ddc9991","year":2022},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:137de64843989380793d5cb2fad5a18ebff27cf50c1f9208d85e78dc475f8709","observation_id":"c9565065-6f90-4fc3-b215-8a3fb4dd4263","resolution":{"observed_at":"2026-05-14T15:11:37.435194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OWASP ModSecurity core rule set","venue":null,"work_id":"5011f0e8-aead-4a5d-ac31-d5e91642f95a","year":2026},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:b31fe327b623ac8adaf8dd6c3ec94caf6fbae2f5d611315eeb8f080fddb33795","observation_id":"e42b9def-d073-4b0a-b12f-ffbaf3584a4f","resolution":{"observed_at":"2026-05-14T15:11:37.460526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Owasp web security testing guide","venue":null,"work_id":"dcc2cd2a-c18e-4220-8b65-f7e167ee9640","year":null},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:d0aeca848162768a0d464fd8c3c0fd3f3a5b8f60088c185568d6c2ad07fc189b","observation_id":"6f50733e-0347-4ded-bf88-d558dcd3f20a","resolution":{"observed_at":"2026-05-14T15:11:37.441836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Owasp top 10 web application security risks","venue":null,"work_id":"2e7f65c9-3e6b-49a7-aebd-38fd6062d4c3","year":2025},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:8f60d9d3f5ef7678206c43cc6267aa654bfcb9b5fca491b5b83bc48856d3ecf7","observation_id":"0bf9ed19-7481-4e77-9b32-13fa65e0a1ac","resolution":{"observed_at":"2026-05-14T15:11:37.467771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11324","last_updated":"2024-07-01T22:28:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-17T15:03:30Z","title":"Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting","version":2},"cited_work":{"arxiv_id":"2310.11324","doi":"10.1109/cdc57313.2025.11312997","metadata_source":"pith","pith_arxiv_id":"2310.11324","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting","venue":"cs.CL","work_id":"c3e484df-e654-4146-8c4e-a16ca850afc7","year":2023},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"cited_paper":"/paper/2310.11324","citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:33ab5264a47fd9ecfb5e41601f5801699dacf87d6f6529dc31c15dcad2b3e023","observation_id":"c80d12c3-6a2f-40a8-a7f5-cfb844a17bd0","resolution":{"observed_at":"2026-05-17T01:59:51.558892Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:02:31.129484Z","title":"A mathematical theory of communication.The Bell system technical journal, 27(3):379–423","venue":null,"work_id":"7fccb4df-f532-41a4-812c-c299de10bb18","year":1948},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:6094c1975ca4908845d4a66917e8abd40462a2eafeb4dbf64c6ab31f5264618f","observation_id":"ebb40d95-d6cb-4d47-9c25-9f9388f10d3a","resolution":{"observed_at":"2026-05-14T15:11:37.458726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06485","last_updated":"2026-04-19T16:57:07Z","snapshot_observed_at":"2026-08-01T08:27:18.464501Z","submitted_at":"2025-06-06T19:20:23Z","title":"Task Matters: Knowledge Requirements Shape LLM Responses to Context-Memory Conflict","version":4},"cited_work":{"arxiv_id":"2506.06485","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.06485","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Task Matters: Knowledge Requirements Shape LLM Responses to Context-Memory Conflict","venue":"cs.CL","work_id":"e492ac45-53bb-42c2-97b8-836139b56cf7","year":2025},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"cited_paper":"/paper/2506.06485","citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:e6f02988fe5e20db67a799f1b62e75d441569f744d7ca08579c13c69a5324b0b","observation_id":"b6bdf221-7c1d-4eea-9a87-4459b060f6d6","resolution":{"observed_at":"2026-05-11T04:10:57.344884Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02276","last_updated":"2026-02-02T16:17:38Z","snapshot_observed_at":"2026-07-06T22:44:09.804048Z","submitted_at":"2026-02-02T16:17:38Z","title":"Kimi K2.5: Visual Agentic Intelligence","version":1},"cited_work":{"arxiv_id":"2602.02276","doi":"10.48550/arxiv.2602.02276","metadata_source":"pith","pith_arxiv_id":"2602.02276","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Kimi K2.5: Visual Agentic Intelligence","venue":"cs.CL","work_id":"d690be8f-5d53-49b0-b1e7-79668eb8fcdb","year":2026},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"cited_paper":"/paper/2602.02276","citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:a1febe3a6ec09e3ff82a542374a781e9c350d179a3162a99d49da9ed8473ae34","observation_id":"5aa40288-7dc7-4b5b-a43e-b3c845633b61","resolution":{"observed_at":"2026-05-11T04:10:57.367863Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.595164Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"a3ac3b4d-8c58-4772-ad55-18e8fb162bd1","year":2022},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:ee763156137d81260100565244c0e6dc0e59b79a7b5939ee0f99e65c44073f0b","observation_id":"030889f8-ebfd-4060-9a7a-8961fa38f5e8","resolution":{"observed_at":"2026-05-14T15:11:37.469753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19361","last_updated":"2025-01-31T18:12:41Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:12:41Z","title":"We're Different, We're the Same: Creative Homogeneity Across LLMs","version":1},"cited_work":{"arxiv_id":"2501.19361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.19361","snapshot_observed_at":"2026-07-03T00:57:30.151320Z","title":"We're Different, We're the Same: Creative Homogeneity Across LLMs","venue":null,"work_id":"fc682fde-4346-4321-b48b-cc32d37cb996","year":2020},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"cited_paper":"/paper/2501.19361","citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:31990ec559123de3c2840fa861b43f5751b0c6dbf823e96e5937af2a8db12eaa","observation_id":"3a6bac01-f8f3-41d7-af44-541159f34fba","resolution":{"observed_at":"2026-05-11T04:10:57.307536Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaptive chameleon or stubborn sloth: Revealing the behavior of large language models in knowledge conflicts","venue":null,"work_id":"6bda1601-b5af-4874-b362-3f5424cdc102","year":2024},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:745b90f6db6b0f838febe3f6062c7356f9cfa769f21688a4db3cc1c320a3b61b","observation_id":"ee4d63a9-b184-4d5a-9314-e4179534dda5","resolution":{"observed_at":"2026-05-14T15:11:37.471539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01038","last_updated":"2024-03-02T00:10:45Z","snapshot_observed_at":"2026-07-06T17:38:26.164353Z","submitted_at":"2024-03-02T00:10:45Z","title":"AutoAttacker: A Large Language Model Guided System to Implement Automatic Cyber-attacks","version":1},"cited_work":{"arxiv_id":"2403.01038","doi":"10.48550/arxiv.2403.01038","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.01038","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"AUTOATTACKER: A large language model guided system to implement automatic cyber-attacks","venue":null,"work_id":"b0ca4ac3-9878-48f2-aafb-5093e10fa068","year":2024},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"cited_paper":"/paper/2403.01038","citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:c1e29f3a13b29ce190ad920a7fec369aaee38fcf70d3232ba905ec894fbeb770","observation_id":"8d7a2e79-2f86-4371-9057-6c92e40136e0","resolution":{"observed_at":"2026-05-11T04:10:57.315417Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Swe-agent: Agent-computer interfaces enable automated software engineering","venue":null,"work_id":"a48ea5ef-a60f-4040-983a-3545f39b60a1","year":2024},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:fe023024c15009d7c4eaf08ad1c1180daa2a460fe53414109a66f52db7a03e15","observation_id":"45d8378f-c0d4-45af-a01a-e2af6f9cfe95","resolution":{"observed_at":"2026-05-14T15:11:37.473322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":"ce8dbcf5-fe84-426b-8ff7-f11a62bde122","year":2023},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:9419abfebdb82f0afd02e9216ee76261ceb129dbab75beb2cbb7b4b0198e2a5f","observation_id":"5a647cc8-1ef6-4ab5-b1e9-ca96afb5560d","resolution":{"observed_at":"2026-05-14T15:11:37.465997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1cb62322-3d07-4237-8f83-4146fb51fc3e","year":2026},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:1a7f4d92fa5c0a26a39628d573b181ff4ad0715b8a77d7c4744831d677fc2c47","observation_id":"c0fc0023-9473-4d66-972c-39ff48a52f5c","resolution":{"observed_at":"2026-05-14T15:11:37.462234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08926","last_updated":"2025-04-12T21:26:07Z","snapshot_observed_at":"2026-07-06T19:01:41.274385Z","submitted_at":"2024-08-15T17:23:10Z","title":"Cybench: A Framework for Evaluating Cybersecurity Capabilities and Risks of Language Models","version":4},"cited_work":{"arxiv_id":"2408.08926","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.08926","snapshot_observed_at":"2026-07-10T18:37:31.168670Z","title":"K., et al","venue":"cs.CR","work_id":"e0f8e335-0df1-4fa1-a820-ae6717e73cc1","year":2024},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"cited_paper":"/paper/2408.08926","citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:fbe4d0b7e0cbd6536bf720b45ac25254bb8b37598008fb015844df3ad8fbb1a1","observation_id":"056324e2-fb99-4104-b553-afcf4b86cac3","resolution":{"observed_at":"2026-05-11T04:10:57.348437Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.15216","doi":"10.48550/arxiv.2505.15216","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Zhang, Joey Ji, Celeste Menders, Riya Dulepet, T","venue":null,"work_id":"13c84db8-c5ad-4f46-880d-9c5e55ddbd8d","year":2025},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:38ba6d71178fdb531ae3ff112538d839c8ddb766065c2eeae7b9199c6b320189","observation_id":"9717259c-c734-4fd1-9c50-0df65db93099","resolution":{"observed_at":"2026-05-11T04:10:57.325784Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-07-06T15:58:31.756298Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":"2307.13854","doi":"10.48550/arxiv.2307.13854","metadata_source":"pith","pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-07-10T14:17:10.112759Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","venue":"cs.AI","work_id":"7058ffd2-a339-4102-89eb-248eeb074652","year":2023},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:71229423b95b20310d9131b187cd89bc7d433fbb5be23151ebf374a8c203eb65","observation_id":"ff88499c-a88c-402d-88cb-6b05ea7f9d60","resolution":{"observed_at":"2026-05-11T04:10:57.330973Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17332","last_updated":"2025-06-24T04:10:59Z","snapshot_observed_at":"2026-07-06T20:56:49.300474Z","submitted_at":"2025-03-21T17:32:32Z","title":"CVE-Bench: A Benchmark for AI Agents' Ability to Exploit Real-World Web Application Vulnerabilities","version":4},"cited_work":{"arxiv_id":"2503.17332","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.17332","snapshot_observed_at":"2026-07-09T20:16:29.518680Z","title":"Cve-bench: A benchmark for ai agents’ ability to exploit real- world web application vulnerabilities.arXiv preprint arXiv:2503.17332, Mar 2025","venue":"cs.CR","work_id":"bc94571d-ef7a-4a07-9e77-219782ca02eb","year":2025},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"cited_paper":"/paper/2503.17332","citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:6d351dc49bfee370a386eae9125cccf5dff39bc70eada1ba16af3f5010db32b3","observation_id":"c46f35e0-fd53-4d56-89b6-7eac907f5e8c","resolution":{"observed_at":"2026-05-11T04:10:57.379648Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"timestamp","venue":null,"work_id":"454987e9-232f-4b31-af16-05157abf7508","year":2026},"citing_paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:46.391345Z"},"links":{"citing_paper":"/paper/2605.07830"},"observation_digest":"sha256:eb5bdb7ef7be5791a4412a6718f41fa8c4745b46696dbb15fa5459f007b65fa2","observation_id":"8f587563-b2fc-4a42-b605-df2256179cfc","resolution":{"observed_at":"2026-05-14T15:11:37.464170Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.07830","last_updated":"2026-05-08T14:57:53Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T14:57:53Z","title":"CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":2,"verified_exact":13,"verified_fuzzy":19},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2605.07830."}