{"as_of":"2026-08-14T14:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4fafec558a05ce38ecd92ff86e7af242bc6deca485fe2c03bfe73c324b013d0e","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T18:56:21.470013Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:44:36.631711Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-10T05:30:23.456663Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-10T05:30:23.456663Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"cited_work":{"arxiv_id":"2411.11180","doi":"10.48550/arxiv.2411.11180","metadata_source":"pith","pith_arxiv_id":"2411.11180","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","venue":"eess.SY","work_id":"75b25c82-3e9c-4137-ab49-ec2852b2ff82","year":2024},"citing_paper":{"arxiv_id":"2508.19541","last_updated":"2025-08-27T03:28:36Z","snapshot_observed_at":"2026-08-09T21:15:14.378282Z","submitted_at":"2025-08-27T03:28:36Z","title":"Hybrid ML-RL Approach for Smart Grid Stability Prediction and Optimized Control Strategy","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T15:44:36.631711Z"},"links":{"cited_paper":"/paper/2411.11180","citing_paper":"/paper/2508.19541"},"observation_digest":"sha256:eda4879437bbfc7de10e1628b2e5f45f16f722f59d2e681cfa3443d38b0abb31","observation_id":"8de69fbe-f8f1-457b-a3c6-42e66ec9d0f4","resolution":{"observed_at":"2026-08-05T15:44:37.817072Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.11180/citation-record","integrity":"/paper/2411.11180/integrity","json":"/paper/2411.11180/citation-record.json","paper":"/paper/2411.11180"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.925076Z","title":"General nonlinear modal representation of large scale power systems,","venue":null,"work_id":"a01a9049-9cb6-47c2-944d-34e519a297a5","year":2003},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.362667Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:3d860cb305f514ad2e8cd4f98dd49c1748cb0e903fe0b5e103ea9f1e4876c73f","observation_id":"5d034281-218e-4f20-8fd2-a8445b0a4c8f","resolution":{"observed_at":"2026-08-12T18:56:21.929539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.912850Z","title":"Efficient and scalable reinforcement learning for large-scale network control,","venue":null,"work_id":"d8650f7e-8db1-4c6e-9e41-b9604ec59698","year":2024},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.367368Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:1414a121fab072a124c33d04250b32233274865031fd756e228efbd00ec5e495","observation_id":"911d5e59-24e6-4e98-8348-f1e15b66dda7","resolution":{"observed_at":"2026-08-12T18:56:21.916828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.901052Z","title":"Deep reinforcement learning for real-time power grid topology optimization,","venue":null,"work_id":"c3066eac-1a3f-4bec-85d5-9a0b8e8f31e6","year":2021},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.371650Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:e82c4b1507a30fd3ff058556a1db3b167df74c481da74dcbc8e31a07fae3a395","observation_id":"a01b41c7-96d6-428d-8b51-2eb7aeafef92","resolution":{"observed_at":"2026-08-12T18:56:21.905242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.889014Z","title":"Study on the structural complexity of large scale power grids,","venue":null,"work_id":"de2eaf70-8622-445e-87d6-15854e9c25cb","year":2013},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.376228Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:81b777a1a4bcb487cf777e3f604f3712b25f09168d34b1b26e811e35825b7465","observation_id":"1d20d713-3a0b-4474-9866-9d49df626b76","resolution":{"observed_at":"2026-08-12T18:56:21.893119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.876045Z","title":"A deep reinforcement learning framework for automatic operation control of power system considering extreme weather events,","venue":null,"work_id":"58720fbd-c88e-41da-9337-d0467c2c77e6","year":2022},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.380744Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:036e8ea30d2c177b3c3304e549966eb8127f320a6c7358f59a656cb61ea73c76","observation_id":"7cb673ba-343c-44b1-a6ab-c512f4a2d609","resolution":{"observed_at":"2026-08-12T18:56:21.880417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.862399Z","title":"Smart grid vulnerability and defense analysis under cascading failure attacks,","venue":null,"work_id":"04d5f1fb-7109-4e58-90c6-95e10e31f0dd","year":2021},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.385610Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:9840fc1d4d0346dbbf039b2be24e5f14e6abc83c7d7940c618f797d5c799b510","observation_id":"cf633952-cd31-4fa4-9a5a-f13d71e9c862","resolution":{"observed_at":"2026-08-12T18:56:21.867361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03104","last_updated":"2021-10-21T17:02:53Z","snapshot_observed_at":"2026-08-14T06:46:49.575644Z","submitted_at":"2021-03-02T09:52:24Z","title":"Learning to run a Power Network Challenge: a Retrospective Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03104","snapshot_observed_at":"2026-08-12T18:56:21.390206Z","title":"Learning to run a power network challenge: a retrospective analysis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.390206Z"},"links":{"cited_paper":"/paper/2103.03104","citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:c31f5076b6989ae058829b740dc2594cc874d19e8dcac5e112cff2f8a6eaa2c4","observation_id":"879fc3a0-51cb-4990-b319-8f7a69ff20ea","resolution":{"observed_at":"2026-08-12T18:56:21.390206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.849982Z","title":"Reinforcement learning agents,","venue":null,"work_id":"924fd800-8d0b-48fb-a718-a29105f60586","year":2002},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.395129Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:d655035bd62d23b04a36414c1be9f948585c44e213ac1cfe3442ede38a66b061","observation_id":"4b487e9c-acd8-4219-ad6d-357f2c780420","resolution":{"observed_at":"2026-08-12T18:56:21.854227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.837653Z","title":"Intelligent hur- ricane resilience enhancement of power distribution systems via deep reinforcement learning,","venue":null,"work_id":"d475b509-f14d-4c4a-a3b4-9790bff7787d","year":2021},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.399048Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:f8d537e4be185bbda1278d4e74ce43c6efc7db83570ff1c41b4258bedef99a6d","observation_id":"077729ad-f221-4e0d-80f4-a1eb5c669681","resolution":{"observed_at":"2026-08-12T18:56:21.842205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.825023Z","title":"Curriculum based reinforcement learning of grid topology controllers to prevent thermal cascading,","venue":null,"work_id":"865b80a3-9e05-4e3e-b70a-5d6b109a44e5","year":2023},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.403232Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:7bcc56f0d79395a52c43d5b2d376ddbad0c3c53840f0646d3d048d68995d985a","observation_id":"459578ca-d5dd-4c97-9ace-8ff0f64e1107","resolution":{"observed_at":"2026-08-12T18:56:21.829396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.806442Z","title":"Curriculum-based reinforcement learning for distribu- tion system critical load restoration,","venue":null,"work_id":"5ed4829e-d1b0-4336-8192-892ee53e51b2","year":2023},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.407163Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:0c6c79392957c3b7e8c89400f363e8c1238c1b32e6d4bf58dbc28d91519e9c15","observation_id":"64310cc6-e338-4eea-aa71-6b8fee87a07f","resolution":{"observed_at":"2026-08-12T18:56:21.816393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.783651Z","title":"Resilience enhancement of multi- agent reinforcement learning-based demand response against adversarial attacks,","venue":null,"work_id":"1026681e-db10-4dc3-ab9d-4ccc15b4b10e","year":2022},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.410671Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:4a8693c28498154966eabbd6fc3ae8512a3abe841b54c17c0f3d2464baf07f45","observation_id":"8861dc8a-05c4-4942-90e1-a6101e1e8229","resolution":{"observed_at":"2026-08-12T18:56:21.788909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.771321Z","title":"PowerGridworld: A framework for multi-agent reinforcement learning in power systems,","venue":null,"work_id":"820736a7-605f-4524-a1f7-ddd1f4ab75f3","year":2022},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.415063Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:0a5cb9614fb901a7282c8cb2e13695189bda7abafc795158b861be044931cf9c","observation_id":"b340b1aa-2041-454a-9316-6aa78c448b3c","resolution":{"observed_at":"2026-08-12T18:56:21.775605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.757460Z","title":"Managing power grids through topology actions: A comparative study between advanced rule-based and reinforcement learning agents,","venue":null,"work_id":"012b59e1-678f-4ad5-ab77-b767c289e4a1","year":2023},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.419072Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:1ceead53055b9cc3fbec82b91a6af34fc5dd0cda5645d0547140020ba56321ad","observation_id":"01e9ab9b-6774-4d82-a17b-50d061d44912","resolution":{"observed_at":"2026-08-12T18:56:21.762340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.744999Z","title":"A new framework integrating reinforcement learning, a rule-based expert system, and decision tree analysis to improve building energy flexibility,","venue":null,"work_id":"06f124f6-5a7a-4a92-a67b-0dabc04a91e9","year":2023},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.422800Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:9b5183f52d44ee8ebf37bda08110765be271b3d66a7353e4b1de1f1ed04531aa","observation_id":"dec25a55-f929-40c1-860e-6d3fcde17fc3","resolution":{"observed_at":"2026-08-12T18:56:21.749134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.732030Z","title":"Grid2Op—A testbed platform to model sequential decision making in power systems,","venue":null,"work_id":"7987ed67-f153-4c64-93ae-c83d186e6261","year":2020},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.426800Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:07733d558b800152cc4c755218cd32495f85ce029000fb176fb10319c55fd04c","observation_id":"ad6dcd61-ba13-48d1-8e29-c4cd9c7a9be9","resolution":{"observed_at":"2026-08-12T18:56:21.736900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.719171Z","title":"A Markov decision process to enhance power system operation resilience during hurricanes,","venue":null,"work_id":"c4d58f98-56b7-4737-af31-4373a1d7ebe4","year":2021},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.430541Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:7801b520ec0aa705f1551ccd687650c5768b6915d0a8730c0b2572f1113847bf","observation_id":"d2543ad4-67e2-4a23-b5b2-cf6b68520628","resolution":{"observed_at":"2026-08-12T18:56:21.723538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.704733Z","title":"Dynamic power management based on continuous-time Markov decision processes,","venue":null,"work_id":"84df72b7-15f1-444d-ab18-dda409b06db3","year":1999},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.434244Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:ef1685fa74c3d05680f105cb437a6c74bebb87ee6d6ec90bc36b538ee5e89f1f","observation_id":"60ee8d32-a66e-4c7d-a1f5-694411a7d90e","resolution":{"observed_at":"2026-08-12T18:56:21.709863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.691280Z","title":"Heterogeneous reinforcement learning for defending power grids against attacks,","venue":null,"work_id":"36abb1c2-0237-412c-ac49-9582573f4568","year":2024},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.437981Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:d2e9593740fda7e61b0111ca375d1e74b7614c0819608f693b01f1a0d54bc062","observation_id":"33097a2b-fcca-46e8-bc4a-c2dfcab38f0d","resolution":{"observed_at":"2026-08-12T18:56:21.695607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.679039Z","title":"Pandapower—An open-source Python tool for con- venient modeling, analysis, and optimization of electric power systems,","venue":null,"work_id":"53c7dc90-0541-480e-931d-e9802a106ee3","year":2018},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.441609Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:0d7c6e0e2f3543b5423a14dd7d5b794ea6cb6acc25e678535f3a80ead1877a09","observation_id":"5da69116-f0ec-40fc-abda-da001f6973d7","resolution":{"observed_at":"2026-08-12T18:56:21.683331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-12T18:56:21.445206Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.445206Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:c7bec7fe98ae0904ea9233600a5d711e383b0737b195bebff85a2903590259f7","observation_id":"bdbde768-d059-4b21-8b45-af64d4bffe84","resolution":{"observed_at":"2026-08-12T18:56:21.445206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1502.05477","last_updated":"2017-04-20T18:04:12Z","snapshot_observed_at":"2026-07-06T04:09:39.172428Z","submitted_at":"2015-02-19T06:44:25Z","title":"Trust Region Policy Optimization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.05477","snapshot_observed_at":"2026-08-12T18:56:21.449908Z","title":"Trust region policy optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.449908Z"},"links":{"cited_paper":"/paper/1502.05477","citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:4ce05b264e36f705851dde0a42102b4ec6f0a090dd15e0601b27b7e1ac27f2f0","observation_id":"fd624ecd-7d6d-44b8-9033-c05bfa527006","resolution":{"observed_at":"2026-08-12T18:56:21.449908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.666117Z","title":"Stable-Baselines3: Reliable reinforcement learning implementations,","venue":null,"work_id":"abbaf278-86a9-4a08-98a6-fefe0983b2b0","year":2021},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.454053Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:c5659c4c3c5787a1b08564b42986ecd52611ae1b4d13fb6fc0bb87a19eaf6d22","observation_id":"bbbc7ba5-23a8-4110-8add-993e49083fc7","resolution":{"observed_at":"2026-08-12T18:56:21.670327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-08-13T22:24:37.672685Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-12T18:56:21.457890Z","title":"Gymnasium: A standard interface for reinforcement learning environments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.457890Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:d0654f7725a117074daaea034de2980f88c423c158fa12a4eb28b742ae342c0f","observation_id":"424182d8-652c-4ae3-a4ca-28886d7207e9","resolution":{"observed_at":"2026-08-12T18:56:21.457890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.653744Z","title":"Topological graph convolutional networks solutions for power distribution grid planning,","venue":null,"work_id":"10e08ce9-a5b9-415d-ab3d-29fdd276c5c2","year":2023},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.462320Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:f4169d295389c83bf9d19a8034bdec197f2f21920abb54eae3cf5d0364afe013","observation_id":"42c32616-a1ba-4bde-b843-86ac43eb3934","resolution":{"observed_at":"2026-08-12T18:56:21.657876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.466403Z","title":"Proximal policy optimization with graph neural networks for optimal power flow,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.466403Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:759cb376eca848293f8f9a0dc588c27dfc4dc875209b223239abb026bd39322f","observation_id":"f43420cb-7752-44d1-a46a-5218bb48138f","resolution":{"observed_at":"2026-08-12T18:56:21.466403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:56:21.638276Z","title":"Fast graph representation learning with PyTorch Geometric,","venue":null,"work_id":"45fb6483-4776-43a9-91f9-df9b61cc5c02","year":2019},"citing_paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T18:56:21.470013Z"},"links":{"citing_paper":"/paper/2411.11180"},"observation_digest":"sha256:ca4329145b482ba11878f0888a255be3ec4a7907b1df146cf6dcbd8824a7fce7","observation_id":"5ed7f0cf-5df3-4b17-b2fd-6c1d6f3c86de","resolution":{"observed_at":"2026-08-12T18:56:21.644824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.11180","last_updated":"2024-11-17T21:30:48Z","latest_version":1,"primary_category":"eess.SY","snapshot_observed_at":"2026-08-12T18:47:37.975939Z","submitted_at":"2024-11-17T21:30:48Z","title":"Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 1 inbound Pith citation observation for arXiv:2411.11180."}