{"as_of":"2026-08-18T23:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fbf8a208d1e8ca40798a6ee1bc40625268eb7bf00479f98164e290cc74d35c1f","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:57:22.228734Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.19488/citation-record","integrity":"/paper/2508.19488/integrity","json":"/paper/2508.19488/citation-record.json","paper":"/paper/2508.19488"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:23.007034Z","title":"Deep learning methods in network intrusion detection: Asurveyandanobjectivecomparison","venue":null,"work_id":"d4322757-6273-4edb-9906-3e7ed7a8dfaa","year":2020},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.045196Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:d0a73e43e2d522dde68a7009c105da4e50a1081a9fc8f2ab16e4aa321818f379","observation_id":"eb6c62a1-7c7f-45f1-bc72-a0109c6833fd","resolution":{"observed_at":"2026-08-15T16:57:23.010882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.995823Z","title":"Unsupervised anomaly detection in network intrusion detection using clusters","venue":null,"work_id":"0bb5cf4e-8f49-4883-b174-d664ba27636e","year":2005},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.049958Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:866e26990b4e7afefa5c36db5affc4317625f39fd2bd60b914ace41e3dcd9d7d","observation_id":"661437bb-3d6f-437f-af1f-407c82504368","resolution":{"observed_at":"2026-08-15T16:57:22.999794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.983069Z","title":"Beehive: large-scale log analysis for detecting suspicious activity in enterprise networks","venue":null,"work_id":"9fe10a58-dd14-49bf-9c6f-fd91c48c48e2","year":2013},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.054152Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:20f562574ff61047c864ae2f3483b6784359500296348baaad7c7579715ee169","observation_id":"1f81c876-8036-4ebf-8da5-25bf409187d4","resolution":{"observed_at":"2026-08-15T16:57:22.987176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.970735Z","title":"Effectiveness of AI/ML in SOAR (Security Automation and Orchestration) Platforms","venue":null,"work_id":"af2a0c5f-c74a-46ba-9aac-a1724c9ff8be","year":2024},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.058280Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:5aeb5fe19148c383dfe6ae2fd6709e74d9c696831ea3344d4f1e79d835ab4f4a","observation_id":"948bfdaf-b60f-47e2-970f-b763c9907512","resolution":{"observed_at":"2026-08-15T16:57:22.975406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.958387Z","title":"Advancing cybersecurity: a comprehensive review of ai-driven detection techniques.Journal of Big Data, 11(1):105, 2024","venue":null,"work_id":"426f4cd8-b240-45a6-9fcb-b30cd93eb661","year":2024},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.062664Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:4c32375bf45f4f26ddc5bcd3e7b17fd3c7181193f9760d82175ebd47dffce9a6","observation_id":"69aab8fe-380e-4131-afc5-f1356a84eb0a","resolution":{"observed_at":"2026-08-15T16:57:22.963211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.944348Z","title":"Cyber-security and reinforcement learning — a brief survey.Engineering Applications of Artificial Intelligence, 114:105116, 2022","venue":null,"work_id":"e72c8943-f1b7-4c0c-88f3-c0ba285a9d1a","year":2022},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.066428Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:15178f8ac803d00accba0181442ca1d0845a48c1136765bc7841ba0774ef23dc","observation_id":"2ca82047-e751-4fd1-86ed-14b255ea5707","resolution":{"observed_at":"2026-08-15T16:57:22.948499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.933222Z","title":"Multi-agent reinforcement learning for cybersecurity: Classification and survey","venue":null,"work_id":"02ecf63d-455e-4200-bfcc-8d137deb4d1a","year":2025},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.070350Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:78dc811e2de39ecb5989533e1dac3272396b0001ea1f7628ae02109dddf9bf0d","observation_id":"c8aec987-f76c-44a2-a421-5fe7957577b7","resolution":{"observed_at":"2026-08-15T16:57:22.937189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11070","last_updated":"2024-07-22T07:08:31Z","snapshot_observed_at":"2026-08-18T01:50:24.780447Z","submitted_at":"2024-07-12T18:34:55Z","title":"Optimal Defender Strategies for CAGE-2 using Causal Modeling and Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11070","snapshot_observed_at":"2026-08-15T16:57:22.073728Z","title":"Optimal defender strategies for CAGE-2 using causal modeling and tree search.arXiv preprint arXiv:2407.11070, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.073728Z"},"links":{"cited_paper":"/paper/2407.11070","citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:83fcbad690204a8f58531041564875e0012302f6cc3b65baf802cbe17dde8ab4","observation_id":"b537314e-1c86-4d17-b1c1-8db871b71acb","resolution":{"observed_at":"2026-08-15T16:57:22.073728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.921174Z","title":"Finding the optimal security policies for autonomous cyber operations with competitive reinforcement learning.IEEE Access, 12:120292– 120305, 2024","venue":null,"work_id":"7d5fb00a-887b-4ef9-bdf7-1c2c7ca35cef","year":2024},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.077427Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:95145a4ce1e93c0f4576f3c729f74dfbbcb3f4eb38d13694b71d6de56d7b4463","observation_id":"c4cf91ab-27ec-4724-8611-fa71ea137a9d","resolution":{"observed_at":"2026-08-15T16:57:22.925439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05799","last_updated":"2021-11-02T02:51:22Z","snapshot_observed_at":"2026-08-14T16:16:01.732040Z","submitted_at":"2019-06-13T16:34:12Z","title":"Deep Reinforcement Learning for Cyber Security","version":4},"cited_work":{"arxiv_id":"1906.05799","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.05799","snapshot_observed_at":"2026-08-15T16:57:22.601175Z","title":"Deep Reinforcement Learning for Cyber Security","venue":"cs.CR","work_id":"7c991216-1606-41e5-8553-529f5aadf018","year":2019},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.081034Z"},"links":{"cited_paper":"/paper/1906.05799","citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:5ac23e5ad31372194cc589fb698c1336a9f1dea44898903d5d6d661c16a47c97","observation_id":"be1f6e09-5451-472d-aead-4cddd0ceb056","resolution":{"observed_at":"2026-08-15T16:57:22.606351Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05939","last_updated":"2023-08-25T14:07:50Z","snapshot_observed_at":"2026-08-16T15:05:47.432323Z","submitted_at":"2023-08-25T14:07:50Z","title":"Learning Cyber Defence Tactics from Scratch with Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05939","snapshot_observed_at":"2026-08-15T16:57:22.084932Z","title":"Learning cyber defence tactics from scratch with multi-agent reinforcement learning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.084932Z"},"links":{"cited_paper":"/paper/2310.05939","citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:8760fde7bc64e4a9d2baeeac05cc675b81a97f21ba48442ae0afe7d7100115e7","observation_id":"f8c2ac90-5c2d-4173-8dba-3a5c5f96f8dd","resolution":{"observed_at":"2026-08-15T16:57:22.084932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.909921Z","title":"CybORG: A Gym for the Development of Autonomous Cyber Agents","venue":null,"work_id":"2bd88f2a-31b2-40bf-8cdf-b457eba8389c","year":2021},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.088981Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:6e5bd44b63ecaa6e8089125849ae25a282c95abb1718a4bd6ed2972d95c00f96","observation_id":"09b794d4-8304-49d5-a308-cc6370ee3e8b","resolution":{"observed_at":"2026-08-15T16:57:22.913805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.899247Z","title":"CyberBattleSim - Microsoft Research","venue":null,"work_id":"d9815e0a-2212-4c4c-9cdc-75515b0856d2","year":2020},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.093266Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:10b18e7272347652b95a25236b1812c51a147e8015d1040e1e3575d0f5016b4a","observation_id":"b6867f9f-c0cc-4a6c-bf9d-0742aabed150","resolution":{"observed_at":"2026-08-15T16:57:22.902984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.888555Z","title":null,"venue":null,"work_id":"1bc1c2aa-4f0b-4170-97fa-ad3a42d49635","year":2013},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.096841Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:7dab6755fd9ba05ba25b04c621b440c2fb0a37170b320b48c2eecf14b91b2c4e","observation_id":"76fe6979-5651-4804-ae94-3595d54bcbfc","resolution":{"observed_at":"2026-08-15T16:57:22.892103Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.877947Z","title":"FlipThem: Modeling Targeted Attacks with FlipIt for Multiple Resources","venue":null,"work_id":"a3dd6872-1420-4fc8-a82c-236de0e785f9","year":2014},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.101110Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:3dffebefebb82a83ddabe4899bc061b5741b9b41b135fe9d51eeb758321dabb0","observation_id":"1e98b636-d77f-4956-af47-0b8c8e3d18a5","resolution":{"observed_at":"2026-08-15T16:57:22.881873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.867200Z","title":"Are we compromised? modelling security assessment games","venue":null,"work_id":"abd8a7c1-eceb-440a-bbb5-fd3410aba897","year":2012},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.104813Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:4a3b8ad530436228c84afd8911fb2797e99fce6faf8b19e37c1c46c22bec5409","observation_id":"98032024-5bfd-47c1-a358-a10369506cc9","resolution":{"observed_at":"2026-08-15T16:57:22.870908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.856075Z","title":"QFlip: An adaptive reinforcement learning strategy for the FlipIt security game","venue":null,"work_id":"89d7df97-dc07-4b35-843d-d531bd62df39","year":2019},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.108393Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:c5b0fff32ca66aa2b01e1fdf97e80111a0cd241d43f1c4cbd39473cb7c2c69dc","observation_id":"a1931fb6-5473-460c-a997-92f68685f54a","resolution":{"observed_at":"2026-08-15T16:57:22.859838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.844352Z","title":"Deep reinforcement learning for FlipIt security game","venue":null,"work_id":"f46deabe-e5f0-4739-9ae8-c07f3728f1cb","year":2022},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.111825Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:fe4c958da9027f9acefc47307a7953296f2082b87e2877331baf883f3660030c","observation_id":"897c71c5-61ff-4009-8c01-7e8d42216818","resolution":{"observed_at":"2026-08-15T16:57:22.848234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.832979Z","title":null,"venue":null,"work_id":"060cd090-8934-4adb-9d51-31b986047a8b","year":1992},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.115392Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:560b8b3e2f34ece5278c76e5b2befcb1cb7bef1b175cf6a7cf5d01901c402ada","observation_id":"61da93c8-de09-471c-b8f7-d2af2a1329d9","resolution":{"observed_at":"2026-08-15T16:57:22.836796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-17T17:19:33.060917Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-15T16:57:22.119494Z","title":"Kavukcuoglu, David Silver, Alex Graves, Ioannis Antonoglou, D","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.119494Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:8148975278cd091a42890687a64dbd709ba75d2cdb586879e87a7a1a0e06d0f3","observation_id":"485115f7-d92d-4aab-9dea-799a01b8c1c5","resolution":{"observed_at":"2026-08-15T16:57:22.119494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.821540Z","title":"Grandmaster level in StarCraft II using multi-agent reinforcement learning","venue":null,"work_id":"dc3e7451-21fa-442b-b645-2258f4290511","year":2019},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.123620Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:c9c6f636e180375411643ca6bec6c2f5f1078a353523f593239786ccbeae8378","observation_id":"3d7c7483-29aa-4c3e-92b4-63d3656a710a","resolution":{"observed_at":"2026-08-15T16:57:22.825740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.810592Z","title":"Mastering the game of go with deep neural networks and tree search.Nature, 529(7587):484–489, 2016","venue":null,"work_id":"4f96a010-3c2e-4362-b7cf-384d3a8d202c","year":2016},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.127199Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:5e03f3c4b9ac2a579a1226611d0c0d5bccb53e46da64f596657745c8778a5a42","observation_id":"a76a0665-a179-4c78-b4ac-45575d1e5d32","resolution":{"observed_at":"2026-08-15T16:57:22.814276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.798984Z","title":"Pipeline PSRO: A Scalable Approach for Finding Approximate Nash Equilibria in Large Games","venue":null,"work_id":"39698333-2e47-4197-a2a4-6690ae310a2a","year":2020},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.130986Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:00ecea5babb91fc7893013f96a4695a8fbc59acbced71a6ee0f4ace62d23fef0","observation_id":"a5aa40d9-994c-4ebe-ab1d-32981acce99b","resolution":{"observed_at":"2026-08-15T16:57:22.803010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00832","last_updated":"2017-11-07T12:38:37Z","snapshot_observed_at":"2026-08-14T20:17:34.199226Z","submitted_at":"2017-11-02T17:34:24Z","title":"A Unified Game-Theoretic Approach to Multiagent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00832","snapshot_observed_at":"2026-08-15T16:57:22.135024Z","title":"A unified game-theoretic approach to multiagent reinforcement learning, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.135024Z"},"links":{"cited_paper":"/paper/1711.00832","citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:8e03de10bced33db65febedd94b2a9c1975d43306bcd1a454fafea273b13f957","observation_id":"15995327-f082-41ef-9fdc-bf93c70d9f55","resolution":{"observed_at":"2026-08-15T16:57:22.135024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T16:57:22.139093Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.139093Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:1d7cbc01d7f78eb299473d43de2efae3abac433995473150fd86fd8b9a267038","observation_id":"73fa5e0a-fc6c-4c79-a2a5-077f48a82994","resolution":{"observed_at":"2026-08-15T16:57:22.139093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.787307Z","title":"FlipNet: Modeling covert and persistent attacks on networked resources","venue":null,"work_id":"c6ddd8bf-16a7-49df-83a2-d17520ed1251","year":2017},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.142952Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:f55fd97f604aaa788c966d4a8154cb2eb674cdc76254caacf2d4949066d10777","observation_id":"d1c20764-4017-439d-9aeb-d3480df50f2d","resolution":{"observed_at":"2026-08-15T16:57:22.791843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.775894Z","title":"Flipleakage: A game-theoretic approach to protect against stealthy attackers in the presence of information leakage","venue":null,"work_id":"ce6009eb-755a-42cd-934c-7bea08af3e82","year":2016},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.146691Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:5cc40cbbd5c439c5dd5272b914c5cf23d402e3f85dac5f3d89708bbe56de2a72","observation_id":"bb8e29f8-d334-486f-b2d7-6be1f7716229","resolution":{"observed_at":"2026-08-15T16:57:22.779901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.763435Z","title":"Dynamic defense strategy against advanced persistent threat with insiders","venue":null,"work_id":"006f12f1-c252-4714-a078-521b474f782f","year":2015},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.150541Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:949cead699a966ee45eae0395eb419c49b6cf7de46dcec89c7067ad222256f5a","observation_id":"9bfbe2fd-ff73-40bc-a0d2-5678c5b69f56","resolution":{"observed_at":"2026-08-15T16:57:22.767225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14180","last_updated":"2021-06-03T14:36:51Z","snapshot_observed_at":"2026-08-06T02:12:30.145884Z","submitted_at":"2020-09-29T17:48:10Z","title":"Learning to Play against Any Mixture of Opponents","version":2},"cited_work":{"arxiv_id":"2009.14180","doi":null,"metadata_source":"pith","pith_arxiv_id":"2009.14180","snapshot_observed_at":"2026-08-15T16:57:22.533209Z","title":"Learning to Play against Any Mixture of Opponents","venue":"cs.MA","work_id":"e7b5bdfe-37de-492c-9d20-ad23370eec62","year":2020},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.154543Z"},"links":{"cited_paper":"/paper/2009.14180","citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:ffd812a20ceb81c1b0ad9ee75f2d7913c229be6f045165a7962c53b8244531f5","observation_id":"b3eac515-10a6-447b-aa6e-0e0799941d00","resolution":{"observed_at":"2026-08-15T16:57:22.537337Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.752129Z","title":"Human-level control through deep reinforcement learning.Nature, 518(7540):529–533, 2015","venue":null,"work_id":"fe33fb41-1497-4d48-a3ed-9d29e310133e","year":2015},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.158674Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:8a24dda4e674bb48db9933cd94840e8c9747fa4dc455da8131e419fe1d610f37","observation_id":"4807c465-fb87-460c-aae9-d6312b406eea","resolution":{"observed_at":"2026-08-15T16:57:22.756266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17351","last_updated":"2025-09-05T17:04:26Z","snapshot_observed_at":"2026-08-16T13:06:52.180786Z","submitted_at":"2024-10-22T18:35:05Z","title":"Hierarchical Multi-agent Reinforcement Learning for Cyber Network Defense","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17351","snapshot_observed_at":"2026-08-15T16:57:22.163589Z","title":"Hierarchical multi-agent reinforcement learning for cyber network defense","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.163589Z"},"links":{"cited_paper":"/paper/2410.17351","citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:c0861b6771ec84084984d16f2a450813844ae7cb9e179b84cc8be4067b4f9727","observation_id":"d8ff49bf-cc89-4d8f-9c0d-75fcac7a3c6f","resolution":{"observed_at":"2026-08-15T16:57:22.163589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.737946Z","title":"Oliehoek","venue":null,"work_id":"1e68a5f8-175d-4739-8a96-eb51ec5477cf","year":2024},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.167438Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:bdaf8f882d474a22a3d7c459289ee8a19e94e3c1c74da25170c4a9a88e545f19","observation_id":"a19a9d1c-6678-4f93-ae52-6bb6933807f1","resolution":{"observed_at":"2026-08-15T16:57:22.743589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.723455Z","title":"Comput- ing optimal equilibria and mechanisms via learning in zero-sum extensive-form games","venue":null,"work_id":"40a762be-10f0-4817-9407-6bafb3e4f23c","year":2023},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.171020Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:084223a56e4130a38bc82037176b9e8e13b4e746f8974d7d3f4c91219427a1af","observation_id":"ab586ab0-acbb-4ba0-b210-93975e63b42a","resolution":{"observed_at":"2026-08-15T16:57:22.728563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.711959Z","title":"Deep reinforcement learning for green security games with real-time information","venue":null,"work_id":"ee3efbed-b5f0-4ee4-a269-1c709d4baa09","year":2019},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.174859Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:c9d2ac74748f7d22806e0134a92c7b599943d435c0fe87c973b8ba47c5e11810","observation_id":"626fffac-5ce1-4f14-9c2a-6c7bb2275134","resolution":{"observed_at":"2026-08-15T16:57:22.715798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08413","last_updated":"2021-06-15T20:11:12Z","snapshot_observed_at":"2026-08-16T18:16:53.289758Z","submitted_at":"2021-06-15T20:11:12Z","title":"Robust Reinforcement Learning Under Minimax Regret for Green Security","version":1},"cited_work":{"arxiv_id":"2106.08413","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.08413","snapshot_observed_at":"2026-08-15T16:57:22.502985Z","title":"Robust Reinforcement Learning Under Minimax Regret for Green Security","venue":"cs.LG","work_id":"9c62f1bd-dc18-4392-9ab2-ce74fc98647a","year":2021},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.179028Z"},"links":{"cited_paper":"/paper/2106.08413","citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:75a87e3a9a0d4be7b24528c1bc9ea77e3857eb822f33216397f48e2c9aec22c5","observation_id":"a37267d3-21b6-4662-8a56-48d2ed3e8e3b","resolution":{"observed_at":"2026-08-15T16:57:22.507666Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12062","last_updated":"2024-04-25T04:07:20Z","snapshot_observed_at":"2026-08-16T15:14:08.711132Z","submitted_at":"2023-07-22T12:10:04Z","title":"Game-Theoretic Robust Reinforcement Learning Handles Temporally-Coupled Perturbations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12062","snapshot_observed_at":"2026-08-15T16:57:22.182982Z","title":"Game-theoretic robust reinforcement learning handles temporally-coupled perturbations, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.182982Z"},"links":{"cited_paper":"/paper/2307.12062","citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:899a4e8bd022ed3a2cb9a96dbcb190b658637b0af687f6597c8590fc437d89e1","observation_id":"b9fd131d-86a4-4d67-9feb-18a44d69841c","resolution":{"observed_at":"2026-08-15T16:57:22.182982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.700386Z","title":"Patrol: Provable defense against adversarial policy in two-player games","venue":null,"work_id":"4def0461-7af4-4cd9-8a0c-017569b52926","year":2023},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.186991Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:3709e4d81ba8cd390a9f417d3f2630e7e6f876f57e07c38ea76de081de437049","observation_id":"0765d367-6119-4a4f-bef3-19e4f4e142cf","resolution":{"observed_at":"2026-08-15T16:57:22.704351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00633","last_updated":"2022-06-01T16:20:46Z","snapshot_observed_at":"2026-08-16T17:25:10.385613Z","submitted_at":"2022-01-28T17:54:45Z","title":"Efficient Policy Space Response Oracles","version":4},"cited_work":{"arxiv_id":"2202.00633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.00633","snapshot_observed_at":"2026-08-15T16:57:22.475433Z","title":"Efficient Policy Space Response Oracles","venue":"cs.GT","work_id":"2de46e3a-cc95-419d-8b5e-277217ff2d1c","year":2022},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.190415Z"},"links":{"cited_paper":"/paper/2202.00633","citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:c81b6383c482f1cccd7c0dce883bb8a933573ad2d04820f6342f884f196ee04c","observation_id":"17364413-4dbe-46d3-b6bd-36a65432691e","resolution":{"observed_at":"2026-08-15T16:57:22.479782Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.194157Z","title":"A survey on self-play methods in reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.194157Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:b90b110c1b358161c92413a8aee5ae2ad5ba5b8c8322e167e0f0819eadf780ae","observation_id":"ddd816d4-27a6-41bb-bcd0-32cb3ee17da7","resolution":{"observed_at":"2026-08-15T16:57:22.194157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00322","last_updated":"2024-07-28T09:39:01Z","snapshot_observed_at":"2026-08-16T14:56:17.209546Z","submitted_at":"2023-09-30T09:35:50Z","title":"Evolving Diverse Red-team Language Models in Multi-round Multi-agent Games","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00322","snapshot_observed_at":"2026-08-15T16:57:22.197956Z","title":"Evolving diverse red-team language models in multi-round multi-agent games, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.197956Z"},"links":{"cited_paper":"/paper/2310.00322","citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:5b7f794d25684798e67f2b4dd77b759bd84f735d89d48b696517b05989c8022d","observation_id":"d0a1e289-57cc-4cfb-9827-eb6e582ba73c","resolution":{"observed_at":"2026-08-15T16:57:22.197956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.688363Z","title":"Finding needles in a moving haystack: Prioritizing alerts with adversarial reinforcement learning","venue":null,"work_id":"fe0365e8-92ae-4116-a73b-e52cf6ab3310","year":2020},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.201965Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:50e84ba658cde97caf2e7300ae2a5e8130b60f15c1939a3e87f5521df33c616e","observation_id":"91fd7a50-09a1-4aa9-be09-6a1b988f0af4","resolution":{"observed_at":"2026-08-15T16:57:22.692781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.676431Z","title":"Lee, Benjamin Lee, G","venue":null,"work_id":"99ae173e-e585-41f1-a8ce-a4c183b59527","year":2023},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.205539Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:3cdeff15214ac28235d6816c872d97b69abeb79de5124085a5520541f30ec3df","observation_id":"6456b723-ef9a-498c-a2fa-77268abae9f8","resolution":{"observed_at":"2026-08-15T16:57:22.680222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.664907Z","title":"Oliehoek and Chris Amato","venue":null,"work_id":"cfa88707-7ff8-40f8-8d5c-2a87568c4e39","year":2016},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.209305Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:b71d642a4c4b91d291b12164281da63f180ef9ba0ebcd997a51270ae378beb46","observation_id":"41d3f7e4-6749-40b6-b7a5-43f593b76eb1","resolution":{"observed_at":"2026-08-15T16:57:22.668734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.651481Z","title":"Scheduled Task/Job: Cron","venue":null,"work_id":"a7b5a02b-a69a-4e6e-b52d-eb05ddb1e4de","year":2025},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.212966Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:c258a967c520472853c3028515dc0bd1e37f6b045bd0d17fca8016449f43f0ec","observation_id":"6d5de2a0-7586-4334-99ef-d77b1a93a2ec","resolution":{"observed_at":"2026-08-15T16:57:22.655845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07388","last_updated":"2023-09-14T02:09:36Z","snapshot_observed_at":"2026-08-17T16:39:05.995951Z","submitted_at":"2023-09-14T02:09:36Z","title":"On Autonomous Agents in a Cyber Defence Environment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07388","snapshot_observed_at":"2026-08-15T16:57:22.217511Z","title":"On autonomous agents in a cyber defence environment, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.217511Z"},"links":{"cited_paper":"/paper/2309.07388","citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:0f6b82085c9b839e049f63825748e3579075171ca17ae3468b951dfbd3327fa5","observation_id":"058dea0c-a5d6-4f60-aca0-59ea90033c6a","resolution":{"observed_at":"2026-08-15T16:57:22.217511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.638992Z","title":"Algorithmic game theory.Commun","venue":null,"work_id":"293c6273-90d8-4c66-b6b0-37c7c2c30e0e","year":2010},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.221296Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:6b3b5566f5b671190ccee5166d077d6add3df923d4f38fcd1cc142e2d6e081e9","observation_id":"5d0e3a9d-1e78-46f1-a5e2-24fb130ba057","resolution":{"observed_at":"2026-08-15T16:57:22.643177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2405.21027","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.369760Z","title":"Fusion-PSRO: Nash policy fusion for policy space response oracles, 2025","venue":null,"work_id":"2e019231-51bd-41f0-836f-757d3b0c5dc0","year":2025},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.225077Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:f1f81e6134109d29ff2e75f6d048b91a40636e7d437cbb0b987f351fe62e5515","observation_id":"2a08c994-ddcc-4e53-bbd7-5c6e4db52a62","resolution":{"observed_at":"2026-08-15T16:57:22.378768Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:57:22.626024Z","title":"Policy space diversity for non-transitive games","venue":null,"work_id":"427a3dce-b02d-4388-a48c-48d7302e8476","year":2023},"citing_paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T16:57:22.228734Z"},"links":{"citing_paper":"/paper/2508.19488"},"observation_digest":"sha256:be1edfa0f79773743d5b4a50d9c6e75c4453ed58ef91928a2f219c349d27522a","observation_id":"b39d9dbe-e212-4c0c-958e-62101545e1a2","resolution":{"observed_at":"2026-08-15T16:57:22.630849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.19488","last_updated":"2025-08-27T00:18:49Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T14:29:43.982665Z","submitted_at":"2025-08-27T00:18:49Z","title":"PoolFlip: A Multi-Agent Reinforcement Learning Security Environment for Cyber Defense"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":5,"verified_fuzzy":31},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2508.19488."}