{"as_of":"2026-08-08T03:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:42c181090c3d6ae14808f416b8c81fdb3e64f7b97338e51f48286f49e72fda18","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:10:44.818148Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T03:03:29.755428Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T03:05:48.238883Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"cited_work":{"arxiv_id":"2505.19837","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19837","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-agent re- inforcement learning in cybersecurity: From fundamentals to applications","venue":null,"work_id":"b4d7865a-132c-4f54-9c48-e736ae9a1287","year":2025},"citing_paper":{"arxiv_id":"2510.25939","last_updated":"2026-04-07T09:33:43Z","snapshot_observed_at":"2026-07-06T22:34:23.736456Z","submitted_at":"2025-10-29T20:20:51Z","title":"SoK: Honeypots & LLMs, More Than the Sum of Their Parts?","version":4},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-05-18T03:03:29.755428Z"},"links":{"cited_paper":"/paper/2505.19837","citing_paper":"/paper/2510.25939"},"observation_digest":"sha256:a7c70120a80e7aea590374113edc6f646dd52b0d521f4b6d99be266fb4ed2214","observation_id":"d96ce6b1-84e4-4bc5-bce4-abc3d1265df8","resolution":{"observed_at":"2026-05-18T03:05:48.240750Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19837/citation-record","integrity":"/paper/2505.19837/integrity","json":"/paper/2505.19837/citation-record.json","paper":"/paper/2505.19837"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.899851Z","title":"Muggah and M","venue":null,"work_id":"830137bd-9b85-4452-8991-cb90d0a964f5","year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:37.936191Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:ef82acc3112b0e63429092053222285029c888b66241f425683262b9e32031e8","observation_id":"0c303911-58c4-4837-972d-0be6a8003aab","resolution":{"observed_at":"2026-08-07T14:10:54.981740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.761941Z","title":"Dynamic vs. static cybersecurity: Which approach is more effective?","venue":null,"work_id":"ba49a862-32d9-478f-829e-aded3d199ab2","year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.021099Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:3e83da063a495aee7182a6de6611d466a9c36a7303cf4a906582a34a5a935a64","observation_id":"ecb94ed6-0dee-48e0-ba0c-c4826bdc1c22","resolution":{"observed_at":"2026-08-07T14:10:54.799402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.723889Z","title":"Does traditional security protect against modern threats?","venue":null,"work_id":"7929833b-6128-47bb-9796-24f19505c69a","year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.127450Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:13c3cbc38a8c30ab5ac61fb3ee1d1186324e4111911a3f176cecef3071c389ce","observation_id":"9d5eac62-7282-4abc-be09-0251f62a03c4","resolution":{"observed_at":"2026-08-07T14:10:54.748066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.675881Z","title":"As the threat landscape changes, traditional cybersecurity approaches need to evolve,","venue":null,"work_id":"05a6861e-eab7-4cdc-8383-d99473aec609","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.246062Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:c8c7af3856c154bb3dfffaf1b810ada073f9ec954d53b484028a593873f778af","observation_id":"fd795b31-ec4f-455b-966c-ea9eb3da1f06","resolution":{"observed_at":"2026-08-07T14:10:54.705345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.627102Z","title":"Cyber grand challenge,","venue":null,"work_id":"3f464f03-369d-4dcc-9f66-2b7549547fea","year":2016},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.356260Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:0930ff2614ea7183c1411f1ce1e92ebe477e01d55e31ecec033fb32900ac5bae","observation_id":"26f0676c-6cfa-4811-b79b-bbf7c92bdba1","resolution":{"observed_at":"2026-08-07T14:10:54.638422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.584614Z","title":"The mayhem cyber reasoning system,","venue":null,"work_id":"f31db422-ec17-4bc9-adb7-444d7bbc275f","year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.469272Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:b0f86038a3e15ec0a758f0422ff214824007e2b2fa4f0a433a73e80f4c8f0c7d","observation_id":"ab79abcb-8462-46e2-842c-016e9cda9290","resolution":{"observed_at":"2026-08-07T14:10:54.598721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.526436Z","title":"Xandra: An autonomous cyber battle system for the cyber grand challenge,","venue":null,"work_id":"42f0bcf6-7a25-4853-8620-4a28b3e2577d","year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.574637Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:dce645a24f2a5b5e37c563333450dfcecd1e00abb2a92377c061eb57908d3284","observation_id":"15c87119-1b65-4326-9ccd-0ee76eb8dff3","resolution":{"observed_at":"2026-08-07T14:10:54.553235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.482908Z","title":"Mechanical phish: Resilient autonomous hacking,","venue":null,"work_id":"a59cf6ca-57f2-4170-aac1-7f4b0d15bdfe","year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.644533Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:571da9655312e0c07e9ef9db27f307ae794f32ec4501f75a730e076e679be003","observation_id":"665549e3-209c-43e9-a3c8-57692ed5071f","resolution":{"observed_at":"2026-08-07T14:10:54.496827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.447146Z","title":"The future of Cyber-Autonomy,","venue":null,"work_id":"7d058a74-bdac-46bc-8830-161813076967","year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.722447Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:d018dceb15bf89ea37f2f0e988383afa411b8cdd35a361e1d99d7024123fec32","observation_id":"021e2aba-26b7-413c-9431-ab10290dd7f0","resolution":{"observed_at":"2026-08-07T14:10:54.459985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.365188Z","title":"Orientation guide for the security of critical infrastructures,","venue":null,"work_id":"660e9c01-dc5e-4df9-be92-c558e32510d0","year":2022},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.798934Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:386a167b074c1a17089a74cb680f6a39856be855f6e8b4891d5ea9e2c3dfca57","observation_id":"7637e23b-9765-43d9-b90a-b1ed1c112322","resolution":{"observed_at":"2026-08-07T14:10:54.422290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.206162Z","title":"Fuzzing: Chal- lenges and reflections,","venue":null,"work_id":"ede5914c-7c73-4e30-a8b3-9b05afb7f390","year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.871919Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:e64ce673c1eca7570d83652679ff57cf0c4d52c7a2d985482f8f70351036713c","observation_id":"e6a26cc9-ab84-424f-bf94-329b7c973b9b","resolution":{"observed_at":"2026-08-07T14:10:54.287932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2020.30409","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:46.775209Z","title":"Reinforcement learning for iot security: A comprehensive survey,","venue":null,"work_id":"33bd8323-fb4b-4fbc-8abd-b28642b1b095","year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:38.963661Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:23c78a072128e273d4a0f6beca831330481c95a0b2695fc6fe201b863b4de706","observation_id":"683dbab7-12c2-4618-a5f4-776848d064dc","resolution":{"observed_at":"2026-08-07T14:10:46.912286Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:54.067177Z","title":"Cyber-security and reinforcement learning — a brief survey,","venue":null,"work_id":"b84bb2b9-53ce-4b82-85f1-b5c5325c9566","year":2022},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.079039Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:656bbbfefde212b72e7220faf606d8150fb411daa5b56a473cc073d514e4983d","observation_id":"fe9052e1-3dad-4fb5-a512-1667bbffd429","resolution":{"observed_at":"2026-08-07T14:10:54.127208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.936517Z","title":"A review of machine learning-based zero-day attack detection: Challenges and future directions,","venue":null,"work_id":"56ac582b-8c0d-4dfc-9426-022b82fe56f7","year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.185882Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:1c5036aedeee020e5c7ffa959d2e07ff3d327a080e4061d701b01fd2c7edd01b","observation_id":"61bcb419-e692-4138-a1e5-6d3714a51825","resolution":{"observed_at":"2026-08-07T14:10:53.980463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-030-30719-6","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:45.054183Z","title":null,"venue":null,"work_id":"78fd1c6b-7bef-4136-ac51-ff696c94ab6f","year":2019},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.279234Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:eb660bc6aeed83f95ca38ae35468d8bb1a55a6dc39a88b322d273ebd463892f1","observation_id":"dd356410-e452-43de-bcf2-52ce7ef30df5","resolution":{"observed_at":"2026-08-07T14:10:45.115443Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.916177Z","title":"Reinforcement learning applications in cyber security: A review,","venue":null,"work_id":"5ab0a67c-a37e-4f2f-ac63-05dbb4a89bea","year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.362945Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:a462b386c640c2e7e6fab464edbbaecaa32f2df62371af6bc75b221d4b8e494b","observation_id":"23c1dc98-c0a1-466e-96fe-db0e40f10897","resolution":{"observed_at":"2026-08-07T14:10:53.920461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11052","last_updated":"2023-04-03T20:43:19Z","snapshot_observed_at":"2026-07-06T15:18:26.300068Z","submitted_at":"2023-04-03T20:43:19Z","title":"A Multiagent CyberBattleSim for RL Cyber Operation Agents","version":1},"cited_work":{"arxiv_id":"2304.11052","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.11052","snapshot_observed_at":"2026-08-07T14:10:46.533577Z","title":"A Multiagent CyberBattleSim for RL Cyber Operation Agents","venue":"cs.CR","work_id":"85104a8d-8d4b-4da5-a78c-9eaf6a054af0","year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.455948Z"},"links":{"cited_paper":"/paper/2304.11052","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:94a2890fb00b9bbcfb119d03a43e27beeae5b0424662f66a07aba672a704ebfe","observation_id":"da40eb9e-d858-4e54-b83a-b4d83f951e84","resolution":{"observed_at":"2026-08-07T14:10:46.628329Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.705947Z","title":"Automated cyber defence: A review,","venue":null,"work_id":"00959037-f52f-4940-a070-6566d0f6eb6c","year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.564908Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:429761b33f95f7f76d74f92ba685f90d5227ef667d405428547bc82cbe261d81","observation_id":"b2acef4d-3bee-4e19-95b2-7fc1fe7d18a8","resolution":{"observed_at":"2026-08-07T14:10:53.856473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07745","last_updated":"2024-09-27T07:26:27Z","snapshot_observed_at":"2026-07-06T16:31:25.350087Z","submitted_at":"2023-10-11T16:24:14Z","title":"Deep Reinforcement Learning for Autonomous Cyber Defence: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07745","snapshot_observed_at":"2026-08-07T14:10:39.668054Z","title":"Deep reinforcement learning for autonomous cyber defence: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.668054Z"},"links":{"cited_paper":"/paper/2310.07745","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:633defa712cf2788cf687ba840dec6d2b56accfdb1acc765e81a7335b6b26e43","observation_id":"4d245b6c-588c-43c5-a0a9-3dbff3007d34","resolution":{"observed_at":"2026-08-07T14:10:39.668054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10788","last_updated":"2024-04-12T19:51:45Z","snapshot_observed_at":"2026-08-03T13:28:58.799483Z","submitted_at":"2024-04-12T19:51:45Z","title":"The Path To Autonomous Cyber Defense","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10788","snapshot_observed_at":"2026-08-07T14:10:39.779777Z","title":"The path to autonomous cyber defense,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.779777Z"},"links":{"cited_paper":"/paper/2404.10788","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:c3fe937a9d9da8b70ccef586fc8be1d7639153fa36685d9b20e017144b64d6d9","observation_id":"98fbf916-86dd-4dfa-8cb7-a4cbd774fa92","resolution":{"observed_at":"2026-08-07T14:10:39.779777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10664","last_updated":"2023-03-22T14:01:19Z","snapshot_observed_at":"2026-07-06T06:30:42.880446Z","submitted_at":"2018-03-28T14:55:53Z","title":"Autonomous Intelligent Cyber-defense Agent (AICA) Reference Architecture. Release 2.0","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10664","snapshot_observed_at":"2026-08-07T14:10:39.888835Z","title":"Autonomous intelligent cyber-defense agent (aica) reference architecture. release 2.0,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:39.888835Z"},"links":{"cited_paper":"/paper/1803.10664","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:4146ee62a689a34b6a5b01964aefdbe681ada303ce0c9d2d0c700337ff1041be","observation_id":"0a649443-1dd9-4bdd-85e6-af880ae6dabb","resolution":{"observed_at":"2026-08-07T14:10:39.888835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.478100Z","title":"Multi-agent deep reinforcement learning: a survey,","venue":null,"work_id":"3ed23aab-9d0a-4046-889f-437c0b74d6ce","year":2022},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.000558Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:7b3943b69416a2f9cdaf6ae31e6100de3e91d26a4537b4b0f8371a6b929c82f0","observation_id":"19b15781-c7f6-473b-a831-fed5d4fdb583","resolution":{"observed_at":"2026-08-07T14:10:53.572138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-07T14:10:40.061190Z","title":"Multi-agent reinforcement learning: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.061190Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:b9a2275a11c97764ed315b30365981edd7cb23eb3c735a3fdb84be03152b4691","observation_id":"af5d2004-caaf-47b6-ac61-7b0028f94f0a","resolution":{"observed_at":"2026-08-07T14:10:40.061190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.438020Z","title":null,"venue":null,"work_id":"355aa3c7-a27b-4ab1-b0bc-76ad4d38980c","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.142181Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:022c9113b39112ba1c879314407ad5633274fae81b6046ca7f6fce92e1aa8fad","observation_id":"c2aa99b8-35eb-4200-b516-85b06d7f88d6","resolution":{"observed_at":"2026-08-07T14:10:53.442394Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.364436Z","title":"Multi-agent reinforcement learning for cybersecurity: Approaches and challenges,","venue":null,"work_id":"2a7fcd18-be63-434d-a9c4-985a34c669a2","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.249780Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:177d2eacd76ba29ba363fac0952e7779ed929237d1d3826ae6c11dc4344c85b8","observation_id":"1ecd6ec4-eecf-4aad-b681-13f389596325","resolution":{"observed_at":"2026-08-07T14:10:53.424997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.271306Z","title":"Design and analysis of decentralized interactive cyber defense approach based on multi-agent coordination,","venue":null,"work_id":"5a80681b-bd19-4bfb-93a2-38f9cac1756a","year":2020},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.328375Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:7dd9fc4c49c7bb6345d41100d3fcf06821051c0a30a604832836864d188faf5e","observation_id":"65b72d68-9080-4ad0-975d-dd80b058ffb0","resolution":{"observed_at":"2026-08-07T14:10:53.312361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.00397","last_updated":"2022-03-01T12:46:28Z","snapshot_observed_at":"2026-08-05T00:05:21.423392Z","submitted_at":"2022-03-01T12:46:28Z","title":"A Theory of Abstraction in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.00397","snapshot_observed_at":"2026-08-07T14:10:40.440922Z","title":"A theory of abstraction in reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.440922Z"},"links":{"cited_paper":"/paper/2203.00397","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:933ee881ddce06b10417a5ec958f518f7f2fcfb214ae9ac7c7a98ed77572173f","observation_id":"62eff5e4-c4ae-4840-b3da-ab2cd23329e9","resolution":{"observed_at":"2026-08-07T14:10:40.440922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.04113","last_updated":"2017-01-15T21:24:45Z","snapshot_observed_at":"2026-07-06T05:26:15.624165Z","submitted_at":"2017-01-15T21:24:45Z","title":"Near Optimal Behavior via Approximate State Abstraction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.04113","snapshot_observed_at":"2026-08-07T14:10:40.586964Z","title":"Near optimal behavior via approximate state abstraction,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.586964Z"},"links":{"cited_paper":"/paper/1701.04113","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:63258464bc7cbbe0c14979a7af33f8efd10170fec16a3bcdfb1b5bdcc91ddff2","observation_id":"6ff6a428-a5a0-4e4e-927c-c0c7e6c0fc70","resolution":{"observed_at":"2026-08-07T14:10:40.586964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.184816Z","title":"State abstraction as compression in apprenticeship learning,","venue":null,"work_id":"1b6e47a7-749f-41fd-b429-bba4c5e9b899","year":2019},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.698039Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:3a4dc3a175cc6badc50584cdf88a5158b7eb0695343dd107d0f7fcc2ad3c4bd3","observation_id":"aefb4935-5878-4255-874e-83bc6c3ef637","resolution":{"observed_at":"2026-08-07T14:10:53.228262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:53.109849Z","title":"Non-cooperative games,","venue":null,"work_id":"07ae7089-f20d-4f86-970b-a2a6b6786730","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.810747Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:68743e731bc657465a08536a016d4b56fe3d240eb5a68ae08b4100bcfd2fe284","observation_id":"e7aa530d-c830-4bdb-8584-1c1aabc71135","resolution":{"observed_at":"2026-08-07T14:10:53.149821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-07T14:10:40.916522Z","title":"Value-decomposition networks for cooperative multi-agent learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.916522Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:0bf2e81a1d6ffb06bee178522e5b0c059da2674b3ce51040a3881394142412ea","observation_id":"86418813-fa96-4e89-a298-ba470745546e","resolution":{"observed_at":"2026-08-07T14:10:40.916522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:52.890974Z","title":"State abstractions for lifelong reinforcement learning,","venue":null,"work_id":"e2f07683-d1d2-4e7f-85e2-50d65daebc13","year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.017357Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:6dc8041d9abc47492cea2371496b530673d216fe69737ad248fe286f38169faf","observation_id":"a613a65b-22e2-4e79-83e2-77d332885e71","resolution":{"observed_at":"2026-08-07T14:10:53.024797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:52.576822Z","title":"Value preserving state-action abstractions,","venue":null,"work_id":"fb1b3d03-1adf-4885-807b-51851500687a","year":2020},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.113473Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:05b44d757d7c9ceac1651d64db61983819ca0bc5de9bee5e8dbd26bf683404f8","observation_id":"464967a7-de0e-4e07-b906-e026d03f375d","resolution":{"observed_at":"2026-08-07T14:10:52.728605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:52.240632Z","title":"Reinforcement learning: An introduction,","venue":null,"work_id":"011751d4-ffaa-40c8-aeb0-d64af51a403a","year":2005},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.227152Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:11d350616303f75c87fc3d6630f236c62e6e6df1dd6a4fcf9111ba35a533e9b4","observation_id":"2cb04fc1-aa2c-481b-86ec-9d55d9377e5d","resolution":{"observed_at":"2026-08-07T14:10:52.394923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:51.946199Z","title":"Shoham and K","venue":null,"work_id":"b81fdb1f-86dc-4607-aea1-93d1d3e52171","year":2008},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.331019Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:3887e210589b648fe044945aae9db70bd23b076586bcbd94693e779e45fcd707","observation_id":"132674a2-08b2-4d12-b32b-90ecf049ba9f","resolution":{"observed_at":"2026-08-07T14:10:52.104769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:51.656831Z","title":"A game theoretic approach to decision and analysis in network intrusion detection,","venue":null,"work_id":"e712d707-1ed5-4d8d-b30e-420f131b9002","year":2003},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.401697Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:ba4236d038d68305de37f7d9e386e5ad83ae42412719ba131abd01149e5c063a","observation_id":"54e138e2-a881-4abb-9dc2-93445719ddc9","resolution":{"observed_at":"2026-08-07T14:10:51.813204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:51.380823Z","title":"Computing optimal randomized resource allocations for massive se- curity games,","venue":null,"work_id":"4985c136-b233-4950-bfbf-33c1ebe40ec7","year":2009},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.498939Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:8f311dcd4b80c743d116586ba026722f7107cd927d81b511e5053f57992c6970","observation_id":"6512679b-44f9-431f-aa89-be15c9da9600","resolution":{"observed_at":"2026-08-07T14:10:51.489671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:50.984593Z","title":"A review of attacker–defender games and cyber security,","venue":null,"work_id":"2a9627bb-cd3b-499b-a63f-16848d4b9be4","year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.608105Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:01270b920d3c802181947242033bb38a2eb70a39bae49c1fbe6a99d331f1be55","observation_id":"0bb13fb0-f3de-4e88-9fe8-685f9d6d7853","resolution":{"observed_at":"2026-08-07T14:10:51.141016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:50.265158Z","title":"Dynamic games in cyber-physical security: An overview,","venue":null,"work_id":"18b85f2c-bc33-4e78-beab-ae35bf491fac","year":2019},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.762018Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:d72d9a59ec56061f5c27156cb657be7223c95f91d7fd5d74d3df0cf0ea75bc66","observation_id":"20426748-ce73-45f0-a272-98e8f3d37fa8","resolution":{"observed_at":"2026-08-07T14:10:50.485982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:49.911064Z","title":"A pomdp approach to the dynamic defense of large-scale cyber networks,","venue":null,"work_id":"84bbadda-109a-458e-b599-2c1072ee7961","year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.838137Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:f80615cae597aaf38d8e00fab426a1ef6805b4b5dd881576cdc98e1bb7b30984","observation_id":"1581552d-6216-4bd3-a4b2-4d01ac466957","resolution":{"observed_at":"2026-08-07T14:10:50.089920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-319-75683-7","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:44.916806Z","title":"Yu and R","venue":null,"work_id":"62763b0a-623c-4f44-afb7-ac383d7a5ed1","year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.921146Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:dc588acb28224de38f83538413bd88bd047459a38d253d167b44dfb9a0b0e4fa","observation_id":"25d67249-29da-4609-998c-511e7ac7e3ab","resolution":{"observed_at":"2026-08-07T14:10:44.979994Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.08779","last_updated":"2015-11-27T20:01:45Z","snapshot_observed_at":"2026-08-06T21:19:58.365426Z","submitted_at":"2015-11-27T20:01:45Z","title":"Multiagent Cooperation and Competition with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.08779","snapshot_observed_at":"2026-08-07T14:10:41.979208Z","title":"Multiagent cooperation and competition with deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.979208Z"},"links":{"cited_paper":"/paper/1511.08779","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:5fffd013b13ce7aa6db3ba36c42356de0c3b256b94cfdf8dab90dfb43a339501","observation_id":"a2bf5d77-2fc3-46d0-b713-14ae3edb74ab","resolution":{"observed_at":"2026-08-07T14:10:41.979208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14471","last_updated":"2021-10-26T06:06:31Z","snapshot_observed_at":"2026-07-06T10:00:02.528060Z","submitted_at":"2020-09-30T06:42:09Z","title":"PettingZoo: Gym for Multi-Agent Reinforcement Learning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14471","snapshot_observed_at":"2026-08-07T14:10:42.069429Z","title":"Pettingzoo: Gym for multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.069429Z"},"links":{"cited_paper":"/paper/2009.14471","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:4eba89a51ca996784f225dc7d6c2695db81217b5c25840fd9c20c31d51cc388b","observation_id":"14835a00-abb9-47c7-9e06-4b32c9b2bd03","resolution":{"observed_at":"2026-08-07T14:10:42.069429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:42.144793Z","title":"Multi- agent actor-critic for mixed cooperative-competitive environments,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.144793Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:78db12ca16fdc8208edf171af9f9a9739a68bc9eae37eafce2952df6c80b283e","observation_id":"caa26b1e-3ed6-4825-b8df-55dcfb072c4e","resolution":{"observed_at":"2026-08-07T14:10:42.144793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:49.645605Z","title":"Markov games as a framework for multi- agent reinforcement learning,","venue":null,"work_id":"03df221e-4bc9-49bc-b02d-744ed4034eca","year":1994},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.325063Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:a883d86cd904feafe76b3822e7e31fc0330c0774ba127241a5c3cd2ade55a27a","observation_id":"fadcc624-5010-43d9-8c42-d39b4ed74bc0","resolution":{"observed_at":"2026-08-07T14:10:49.722049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.08926","last_updated":"2024-12-11T14:05:03Z","snapshot_observed_at":"2026-08-07T09:25:41.161029Z","submitted_at":"2017-05-24T18:52:17Z","title":"Counterfactual Multi-Agent Policy Gradients","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.08926","snapshot_observed_at":"2026-08-07T14:10:42.409639Z","title":"Counterfactual multi-agent policy gradients,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.409639Z"},"links":{"cited_paper":"/paper/1705.08926","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:a06079dbf5937f52c9cfb1c0003e60416780b407004ace4aee8b2be0a2e9cf42","observation_id":"433f8291-d7e6-42ed-b59a-90a9e52d0579","resolution":{"observed_at":"2026-08-07T14:10:42.409639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.11485","last_updated":"2018-06-06T17:58:09Z","snapshot_observed_at":"2026-08-06T12:03:41.509273Z","submitted_at":"2018-03-30T14:23:39Z","title":"QMIX: Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.11485","snapshot_observed_at":"2026-08-07T14:10:42.528804Z","title":"Qmix: Monotonic value function factorisation for deep multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.528804Z"},"links":{"cited_paper":"/paper/1803.11485","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:e006da2b5694a6f219e86670d4b877c1742aff65639710ae284a417559f37676","observation_id":"66162488-6c90-4c99-a12c-707e2585dbe3","resolution":{"observed_at":"2026-08-07T14:10:42.528804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T14:10:42.618514Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.618514Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:ad49b7f6a414c0745ab5f01375901526ac8050d87338a3426ea89c101c626a02","observation_id":"00ae0741-ad49-4e0b-9693-d344a3f3e80c","resolution":{"observed_at":"2026-08-07T14:10:42.618514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-07T14:10:42.712252Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.712252Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:3ea5a14722c8267a5ac6dc6d25531ef4c6ffdb3d1735f0b5d209ad2eac1dbe29","observation_id":"8463c1e6-1c4a-4b5e-8678-8e0ffa96a375","resolution":{"observed_at":"2026-08-07T14:10:42.712252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:49.433812Z","title":"The surprising effectiveness of ppo in cooperative, multi-agent games,","venue":null,"work_id":"07c0fdd3-a7f7-42f8-880c-64fb1954eb64","year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.802123Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:48dfc7c9c006dabf78ab9c095decb4f4216640bdd31c313f4208610982bda2e6","observation_id":"7f03e07d-4e9d-4cca-b3c4-c63aeb9b3c1d","resolution":{"observed_at":"2026-08-07T14:10:49.509553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:49.264313Z","title":"Deterministic policy gradient algorithms,","venue":null,"work_id":"5d28c791-60c3-40d7-bc96-22a2d4f9fda9","year":2014},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.952014Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:916c2ec54669464aa6a88eeb40fe3dcffaef465410c9234a486c57312f7ee2b7","observation_id":"2bc2e6be-22f7-4686-94b1-4f8b7e2f6eb0","resolution":{"observed_at":"2026-08-07T14:10:49.344647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:49.084756Z","title":"Cyberbattlesim,","venue":null,"work_id":"a9a3e7ab-41ed-430a-a282-5ae97a4013f5","year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.026152Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:a1c1b257949362e1dd1f210a3f182c1a8a066188ecdc79b537f5104b2f751ad4","observation_id":"2c019d88-0bff-4a1f-81cd-e173715b3976","resolution":{"observed_at":"2026-08-07T14:10:49.177942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17246","last_updated":"2023-08-18T11:32:44Z","snapshot_observed_at":"2026-07-06T15:34:09.163519Z","submitted_at":"2023-05-26T20:19:09Z","title":"NASimEmu: Network Attack Simulator & Emulator for Training Agents Generalizing to Novel Scenarios","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17246","snapshot_observed_at":"2026-08-07T14:10:43.095286Z","title":"Nasimemu: Network attack simulator & emulator for training agents generalizing to novel scenarios,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.095286Z"},"links":{"cited_paper":"/paper/2305.17246","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:ed4dcbe030be942996d57616122c98c80095f1862123dc132414adb39ade5ef3","observation_id":"576103ca-3a31-422c-9b90-24d69c4f3825","resolution":{"observed_at":"2026-08-07T14:10:43.095286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13708","last_updated":"2023-11-06T10:21:19Z","snapshot_observed_at":"2026-07-06T14:09:56.872766Z","submitted_at":"2022-10-11T03:11:12Z","title":"MARLlib: A Scalable and Efficient Multi-agent Reinforcement Learning Library","version":4},"cited_work":{"arxiv_id":"2210.13708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.13708","snapshot_observed_at":"2026-08-07T14:10:46.132599Z","title":"MARLlib: A Scalable and Efficient Multi-agent Reinforcement Learning Library","venue":"cs.LG","work_id":"3b2b9b38-71ff-405a-b8d5-d3e36cd19a58","year":2022},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.177576Z"},"links":{"cited_paper":"/paper/2210.13708","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:c13b789b9b9ac05cb613871d22c7a719b31a2fbee89b785b986601595e4b7e86","observation_id":"3b3a8c17-8a6e-44b4-9b62-fd332c91b719","resolution":{"observed_at":"2026-08-07T14:10:46.190469Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-07-06T07:32:24.974529Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-07T14:10:43.252614Z","title":"The starcraft multi-agent challenge,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.252614Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:7560acee8121228f03299d6e139b83d5b201f9c255118e30e3888927ff978427","observation_id":"92c7db2b-d470-4bae-89d4-e589f727fc66","resolution":{"observed_at":"2026-08-07T14:10:43.252614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:48.890110Z","title":"Openspiel: A framework for reinforcement learning in games,","venue":null,"work_id":"530a4013-a204-4d03-9e8e-006d5691ff93","year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.334397Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:2d2f86fdb085dc1e718266b90232b7a5bbbc1c665d0d21eb57748d17eef96436","observation_id":"a86f7fa6-5157-4bd6-a203-a702b346840f","resolution":{"observed_at":"2026-08-07T14:10:48.991341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8475.28084","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:45.938829Z","title":"Vine: A cyber emulation environment for mtd experimentation,","venue":null,"work_id":"1b45a0cc-161c-4275-be37-c2f063e966ae","year":2015},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.474011Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:d525cd193f689987c2921293031c71c075281537b8ced9a24c5374c8c0a0bcb0","observation_id":"fba9c627-687a-4688-853f-fcffefd5472b","resolution":{"observed_at":"2026-08-07T14:10:46.023983Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10149","last_updated":"2024-01-18T17:22:22Z","snapshot_observed_at":"2026-08-06T12:41:26.207761Z","submitted_at":"2024-01-18T17:22:22Z","title":"Multi-Agent Reinforcement Learning for Maritime Operational Technology Cyber Security","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10149","snapshot_observed_at":"2026-08-07T14:10:43.536990Z","title":"Multi-agent reinforcement learning for maritime operational technology cyber security,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.536990Z"},"links":{"cited_paper":"/paper/2401.10149","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:d8ce65478c4352ab4bafd991c0beb6299b89bd79a7bd4c465fd1c0ffca4fa182","observation_id":"4f728629-6a63-4c53-8c18-85cd4584f560","resolution":{"observed_at":"2026-08-07T14:10:43.536990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16324","last_updated":"2024-10-18T11:04:07Z","snapshot_observed_at":"2026-07-06T19:37:20.613838Z","submitted_at":"2024-10-18T11:04:07Z","title":"CybORG++: An Enhanced Gym for the Development of Autonomous Cyber Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16324","snapshot_observed_at":"2026-08-07T14:10:43.633319Z","title":"Cyborg++: An enhanced gym for the development of autonomous cyber agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.633319Z"},"links":{"cited_paper":"/paper/2410.16324","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:76fa2f8c8e5074bde7ef222d3ff367f05e617176aaa0c8e03612383bd64a0a5c","observation_id":"d76b971b-2a29-4840-9b47-e9bb3098925e","resolution":{"observed_at":"2026-08-07T14:10:43.633319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.09453","last_updated":"2020-09-26T11:49:05Z","snapshot_observed_at":"2026-08-04T22:42:57.075441Z","submitted_at":"2019-08-26T03:31:35Z","title":"OpenSpiel: A Framework for Reinforcement Learning in Games","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.09453","snapshot_observed_at":"2026-08-07T14:10:43.393091Z","title":"Available: https://arxiv.org/abs/1908.09453","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.393091Z"},"links":{"cited_paper":"/paper/1908.09453","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:ea7aba73cda33658548722d84bb25d6afe326e3d919a462a2953765bce4f4604","observation_id":"6ee9fcd7-5b99-4b88-8110-13ddb198f4eb","resolution":{"observed_at":"2026-08-07T14:10:43.393091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:48.531001Z","title":"Exploring the efficacy of multi-agent reinforcement learning for au- tonomous cyber defence: A cage challenge 4 perspective,","venue":null,"work_id":"b1b253a5-3655-40b1-a8ee-a25e8c078911","year":2025},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.883819Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:75e368dbd439d2720430da7fe16061073bf8d63fd777bf8ff9ded5a5c9ddbcfd","observation_id":"f5cba973-7104-4267-9fc3-d242e87e9d22","resolution":{"observed_at":"2026-08-07T14:10:48.622940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:48.334823Z","title":"Towards an ai-powered player in cyber defence exercises,","venue":null,"work_id":"a08d4bdd-355c-47fb-a1b5-b6213a256bc3","year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.975923Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:d4af321e23d30b99965cd97d50b1451f5f83cddea94c08daefef8c255cd1404b","observation_id":"97f0d783-314f-437d-920d-56e304a20b71","resolution":{"observed_at":"2026-08-07T14:10:48.423636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.07612","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:45.692012Z","title":"A survey for deep reinforcement learning based network intrusion detection,","venue":null,"work_id":"a49f841e-e1e0-4067-8738-7b7ae04bde55","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.098856Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:1c4216f52824f3278ea19ac641ff835308ff69b48b63983efbf0bb09f011e430","observation_id":"ce444609-fe8e-4584-8c37-0efb52ba47af","resolution":{"observed_at":"2026-08-07T14:10:45.767297Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:48.748866Z","title":"Cyborg: An autonomous cyber operations research gym,","venue":null,"work_id":"960a56c1-0d7d-430f-a905-2e489d677129","year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.735855Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:377eca4615aba37e18f3652f11ef695d47682f70c1aee387b56a2bde9a93834a","observation_id":"c6b9e9c9-2d36-4d18-a789-34f6a54f3371","resolution":{"observed_at":"2026-08-07T14:10:48.803503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.10667","last_updated":"2020-02-26T02:24:11Z","snapshot_observed_at":"2026-08-02T15:09:55.726542Z","submitted_at":"2020-02-25T04:59:24Z","title":"CybORG: An Autonomous Cyber Operations Research Gym","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.10667","snapshot_observed_at":"2026-08-07T14:10:43.802178Z","title":"Available: https://arxiv.org/abs/2002.10667","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:43.802178Z"},"links":{"cited_paper":"/paper/2002.10667","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:0e5676eb9d7d85541b25ec969a9bc297e9620cc85b0c4162a4d275e58dfe230f","observation_id":"6b3fb465-29d3-4841-98fd-a50cf7650883","resolution":{"observed_at":"2026-08-07T14:10:43.802178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:47.790938Z","title":"Csle: Cyber security learning environment,","venue":null,"work_id":"968cc7fb-a70b-4d4a-aeb1-795044f573e8","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.380779Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:d66e86f48a31c43e84535fadb1445d5374b2ec63f42769f2ff69d76df4a5a3c1","observation_id":"6e56e36d-f32b-46ae-9ae2-444f44f65f22","resolution":{"observed_at":"2026-08-07T14:10:47.840303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:44.447459Z","title":"Combating advanced persistent threats: Challenges and solutions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.447459Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:8ab83cebbaec74f9dddfaa32e5b3e2898d07881a9bcca8b6aa67c562d464f08a","observation_id":"5cad2d08-770e-4e1b-a221-7967bcbcfec6","resolution":{"observed_at":"2026-08-07T14:10:44.447459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:47.632572Z","title":"Lateral movement (ta0008),","venue":null,"work_id":"b668aa79-597e-432d-81f8-72eab5ccacdb","year":2019},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.551463Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:f8d182f4cc17cd7865caa5ec1dedc0888aee262b723157079ea6ca9cc0912ca9","observation_id":"af88656d-54e6-4c9c-b836-7630d44ba17a","resolution":{"observed_at":"2026-08-07T14:10:47.722260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:48.125147Z","title":"Deep q-learning based reinforcement learning approach for network intrusion detection,","venue":null,"work_id":"78604d15-8163-4060-918d-0ddf0a4e1323","year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.160429Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:c99de22aed73ad0ad3fd27b18311caff8a2c36cea16798f19bf5360e40016e59","observation_id":"6f2a2327-2cef-4cdd-9a84-35ce28378a04","resolution":{"observed_at":"2026-08-07T14:10:48.220895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:47.206877Z","title":"Exploitation of remote services (t1210),","venue":null,"work_id":"c6ffff2a-0b5c-463e-b1af-4b0314d618b5","year":2022},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.683000Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:535173e4a405d3afcfe819ee552d0b0fe8e41775c0efc49cd79ff5bed7848806","observation_id":"115bf963-b166-414b-87a5-242bec0624bd","resolution":{"observed_at":"2026-08-07T14:10:47.303119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:47.938429Z","title":"Cy- bershield: A competitive simulation environment for training ai in cybersecurity,","venue":null,"work_id":"4a628c26-6b99-400f-b576-c6de94dcfd3f","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.311218Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:e311e11a6b13680ff63e98b52d674543c3d0d82a735ff432891f48609c6ad85d","observation_id":"02621236-e1f8-451d-8f82-dfe8b6be9aa8","resolution":{"observed_at":"2026-08-07T14:10:48.023140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.13981","last_updated":"2020-10-06T01:25:03Z","snapshot_observed_at":"2026-08-07T22:54:58.065738Z","submitted_at":"2020-07-28T04:13:43Z","title":"Farsighted Risk Mitigation of Lateral Movement Using Dynamic Cognitive Honeypots","version":2},"cited_work":{"arxiv_id":"2007.13981","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.13981","snapshot_observed_at":"2026-08-07T14:10:45.199757Z","title":"Farsighted Risk Mitigation of Lateral Movement Using Dynamic Cognitive Honeypots","venue":"cs.NI","work_id":"228e35e7-2dd2-49a0-a3e7-539cfc0a5a1e","year":2020},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.818148Z"},"links":{"cited_paper":"/paper/2007.13981","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:0ad01cf6c02c14e2191228a7ff58c0bce59c806cfea2a821dcd83c9cecb5157b","observation_id":"937242ae-a1f3-4129-92b6-972b58465a0e","resolution":{"observed_at":"2026-08-07T14:10:45.257838Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:47.422704Z","title":"Os credential dumping (t1003),","venue":null,"work_id":"9a3d03f0-117d-494a-91fa-b62b9d776dcc","year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.621429Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:2377f6ec293632ecd4f9c7221aa9ae5a44232eeacc1a0d0c784ae751fe102e91","observation_id":"13f801da-c42e-40f7-98dd-b4820fee3e50","resolution":{"observed_at":"2026-08-07T14:10:47.533296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:46.985673Z","title":"Privilege escalation (ta0004),","venue":null,"work_id":"df8e29a9-48e6-4d68-b223-6c4650db8622","year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.743947Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:c077679647fba9047052ea8bae5684104b57fe91807cbe86da2eb49ee244881a","observation_id":"79ba06a1-f19b-4172-a6c9-559343b2b65e","resolution":{"observed_at":"2026-08-07T14:10:47.131494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02275","last_updated":"2020-03-14T20:33:00Z","snapshot_observed_at":"2026-08-04T19:23:21.346128Z","submitted_at":"2017-06-07T17:35:00Z","title":"Multi-Agent Actor-Critic for Mixed Cooperative-Competitive Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02275","snapshot_observed_at":"2026-08-07T14:10:42.258052Z","title":"Available: https://arxiv.org/abs/1706.02275","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.258052Z"},"links":{"cited_paper":"/paper/1706.02275","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:ed7b8b3921067ca6aeebd0a274bdc9f79b735e066bd5772c03ac9f9a2ace6eb3","observation_id":"a4950266-b309-4b29-885c-3877313e1841","resolution":{"observed_at":"2026-08-07T14:10:42.258052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.13978","last_updated":"2021-11-27T20:18:00Z","snapshot_observed_at":"2026-07-06T12:12:46.229217Z","submitted_at":"2021-11-27T20:18:00Z","title":"Deep Q-Learning based Reinforcement Learning Approach for Network Intrusion Detection","version":1},"cited_work":{"arxiv_id":"2111.13978","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.13978","snapshot_observed_at":"2026-08-07T14:10:45.511819Z","title":"Deep Q-Learning based Reinforcement Learning Approach for Network Intrusion Detection","venue":"cs.CR","work_id":"d005a782-d039-40f1-887c-2132cd001b7c","year":2021},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:44.236995Z"},"links":{"cited_paper":"/paper/2111.13978","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:ee3cf398858dd69f1e442e31b6eb9ca3e84265893ffab6db894771af09aa9776","observation_id":"a6219ee9-f649-48ec-958a-4ade2951d41b","resolution":{"observed_at":"2026-08-07T14:10:45.551198Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.01955","last_updated":"2022-11-04T06:16:11Z","snapshot_observed_at":"2026-07-06T10:46:11.856932Z","submitted_at":"2021-03-02T18:59:56Z","title":"The Surprising Effectiveness of PPO in Cooperative, Multi-Agent Games","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.01955","snapshot_observed_at":"2026-08-07T14:10:42.885123Z","title":"Available: https://arxiv.org/abs/2103.01955","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:42.885123Z"},"links":{"cited_paper":"/paper/2103.01955","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:185f9017097231c26618e45a0acf7cc0489707d2800d3403b2f7a9482c4dd892","observation_id":"c273e565-dba9-418f-a06a-1c828020ccd6","resolution":{"observed_at":"2026-08-07T14:10:42.885123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:10:50.634530Z","title":"Available: https://www.mdpi.com/2073-4336/15/4/28","venue":null,"work_id":"8c9ead8c-1e1f-4d60-b635-f261dd44e773","year":null},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:41.680463Z"},"links":{"citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:7d8a00d59a1d9970b2bf816801b18c11fee1d4487271b14945fffb31479dc1ec","observation_id":"0c080564-5c4b-4180-98ff-f463f26ad388","resolution":{"observed_at":"2026-08-07T14:10:50.796686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-07T14:03:11.036063Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":24,"verified_exact":6,"verified_fuzzy":45},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 1 inbound Pith citation observation for arXiv:2505.19837."}