{"state_type":"pith_open_graph_state","state_version":"1.0","pith_number":"pith:2024:U32RRUPYLP32FZUGKSZJW256N3","merge_version":"pith-open-graph-merge-v1","event_count":2,"valid_event_count":2,"invalid_event_count":0,"equivocation_count":0,"current":{"canonical_record":{"metadata":{"abstract_canon_sha256":"84a60d9047a7e303c598bc6400fb9401e5410db17acaf615772569118df5334f","cross_cats_sorted":["cs.CR"],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2024-10-23T08:04:12Z","title_canon_sha256":"0ff233580afa1989adbf4163406a237ede741f4c09b819735d6d894107c75c45"},"schema_version":"1.0","source":{"id":"2410.17647","kind":"arxiv","version":3}},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2410.17647","created_at":"2026-07-05T10:04:58Z"},{"alias_kind":"arxiv_version","alias_value":"2410.17647v3","created_at":"2026-07-05T10:04:58Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2410.17647","created_at":"2026-07-05T10:04:58Z"},{"alias_kind":"pith_short_12","alias_value":"U32RRUPYLP32","created_at":"2026-07-05T10:04:58Z"},{"alias_kind":"pith_short_16","alias_value":"U32RRUPYLP32FZUG","created_at":"2026-07-05T10:04:58Z"},{"alias_kind":"pith_short_8","alias_value":"U32RRUPY","created_at":"2026-07-05T10:04:58Z"}],"graph_snapshots":[{"event_id":"sha256:813780c9adf16e8e1f3d95b06b107b4f985edced9506740ab6bdacc6f1ce54c4","target":"graph","created_at":"2026-07-05T10:04:58Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"graph_snapshot":{"author_claims":{"count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","strong_count":0},"builder_version":"pith-number-builder-2026-05-17-v1","claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"integrity":{"available":true,"clean":true,"detectors_run":[],"endpoint":"/pith/2410.17647/integrity.json","findings":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938","summary":{"advisory":0,"by_detector":{},"critical":0,"informational":0}},"paper":{"abstract_excerpt":"A significant challenge for autonomous cyber defence is ensuring a defensive agent's ability to generalise across diverse network topologies and configurations. This capability is necessary for agents to remain effective when deployed in dynamically changing environments, such as an enterprise network where devices may frequently join and leave. Standard approaches to deep reinforcement learning, where policies are parameterised using a fixed-input multi-layer perceptron (MLP) expect fixed-size observation and action spaces. In autonomous cyber defence, this makes it hard to develop agents tha","authors_text":"Alberto Caron, Chris Hicks, Isaac Symes Thompson, Vasilios Mavroudis","cross_cats":["cs.CR"],"headline":"","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2024-10-23T08:04:12Z","title":"Entity-based Reinforcement Learning for Autonomous Cyber Defence"},"references":{"count":0,"internal_anchors":0,"resolved_work":0,"sample":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2410.17647","kind":"arxiv","version":3},"verdict":{"created_at":null,"id":null,"model_set":{},"one_line_summary":"","pipeline_version":null,"pith_extraction_headline":"","strongest_claim":"","weakest_assumption":""}},"verdict_id":null}}],"author_attestations":[],"timestamp_anchors":[],"storage_attestations":[],"citation_signatures":[],"replication_records":[],"corrections":[],"mirror_hints":[],"record_created":{"event_id":"sha256:f45e1d3730f57fbcbd92f4c85391d0dba6213afd762b6de1419ebb5712dfb3ee","target":"record","created_at":"2026-07-05T10:04:58Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"attestation_state":"computed","canonical_record":{"metadata":{"abstract_canon_sha256":"84a60d9047a7e303c598bc6400fb9401e5410db17acaf615772569118df5334f","cross_cats_sorted":["cs.CR"],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2024-10-23T08:04:12Z","title_canon_sha256":"0ff233580afa1989adbf4163406a237ede741f4c09b819735d6d894107c75c45"},"schema_version":"1.0","source":{"id":"2410.17647","kind":"arxiv","version":3}},"canonical_sha256":"a6f518d1f85bf7a2e68654b29b6bbe6ef405ede49736ed442897ee559db6a0a9","receipt":{"algorithm":"ed25519","builder_version":"pith-number-builder-2026-05-17-v1","canonical_sha256":"a6f518d1f85bf7a2e68654b29b6bbe6ef405ede49736ed442897ee559db6a0a9","first_computed_at":"2026-07-05T10:04:58.387133Z","key_id":"pith-v1-2026-05","kind":"pith_receipt","last_reissued_at":"2026-07-05T10:04:58.387133Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","receipt_version":"0.3","signature_b64":"2oUBc7XYqD7ukUd14qEubC7gPCTWamTU6EvCKyS9Byp7FMbgVfe51+ldK76bSFTt0WopDfuXbi6C8X143+UFDw==","signature_status":"signed_v1","signed_at":"2026-07-05T10:04:58.387565Z","signed_message":"canonical_sha256_bytes"},"source_id":"2410.17647","source_kind":"arxiv","source_version":3}}},"equivocations":[],"invalid_events":[],"applied_event_ids":["sha256:f45e1d3730f57fbcbd92f4c85391d0dba6213afd762b6de1419ebb5712dfb3ee","sha256:813780c9adf16e8e1f3d95b06b107b4f985edced9506740ab6bdacc6f1ce54c4"],"state_sha256":"11359aa49741a6ff8610b328dad7ec54adffc81e5c3f78f2a13d25b743b61376"}