{"as_of":"2026-08-11T08:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4079dec3a3c1fc9d98d67de2a9146f4200276008fad41f628622c832de798fb4","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T13:53:34.118084Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.00040/citation-record","integrity":"/paper/2502.00040/integrity","json":"/paper/2502.00040/citation-record.json","paper":"/paper/2502.00040"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:35.552910Z","title":"An optimal transmission line switching and bus splitting heuristic incorporating ac and n-1 contingency constraints,","venue":null,"work_id":"3aa722ee-dee1-485f-b2cc-e6f5f0640e13","year":2021},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.484233Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:a778899cfb272253fda0f06ccdbdcb8450f5bdc40eca078ae9495374cc40fb93","observation_id":"84a3ad62-1ccb-41bd-b314-3fff26edd628","resolution":{"observed_at":"2026-08-10T13:53:35.557915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:35.538968Z","title":"An iterative approach to grid topology and redispatch optimization in congestion management,","venue":null,"work_id":"09476e92-4b48-49fe-9039-80ba5830cd7f","year":2024},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.579948Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:03d1f79e25932354e6936f67afc8a66f8d68e4556f1610a388a12f7deede4766","observation_id":"e25c7117-659b-407d-ac38-80e6ddeec774","resolution":{"observed_at":"2026-08-10T13:53:35.543821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:33.666607Z","title":"Learning to run a power network challenge for training topology controllers,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.666607Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:a3e42a1f588a8deba7d488e9b808c7dddad02ef8b828acb640e8281eb842fff2","observation_id":"5848dd4c-d493-44b0-86e0-c881e7a15035","resolution":{"observed_at":"2026-08-10T13:53:33.666607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:35.512812Z","title":"Gridoptions tool: Real-world day-ahead congestion management using topological remedial actions,","venue":null,"work_id":"d01b2768-4ab9-4f44-9cf2-9a4621838860","year":2024},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.676925Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:8712ac9f780c9295a67dea16ee49f8bd8a22cfb8e7086f660b153fa4a3f339cc","observation_id":"d461d8ed-e774-4ed0-84d2-f65ef46f055d","resolution":{"observed_at":"2026-08-10T13:53:35.518096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:35.497149Z","title":"Transmission congestion management via node-breaker topology con- trol,","venue":null,"work_id":"f73008c8-21d5-44cf-bbc2-6af77c9e54d4","year":2023},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.681570Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:e38e27a89143394f1ce0beb7ace982a12051c8d3d7a46439605846d6cc7f9b9a","observation_id":"4fb228b4-1991-45fe-bd65-7b9e6bdfa768","resolution":{"observed_at":"2026-08-10T13:53:35.502785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:35.482284Z","title":"Expert system for topological remedial action discovery in smart grids,","venue":null,"work_id":"93e3f1e7-4bc3-4b32-8a49-97151331c11d","year":2018},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.686139Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:af06d932930906e0d08cd081ddc2052573d89261fbda14e42f6e128115d972da","observation_id":"fbbfa35f-b02c-404d-bd17-31fb4fe69751","resolution":{"observed_at":"2026-08-10T13:53:35.486858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:35.468121Z","title":"Substation reconfiguration selection algorithm based on ptdfs for congestion management and rl approach,","venue":null,"work_id":"fecd4c4e-3b77-46a9-a165-21ab70627c60","year":2024},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.691133Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:67b2c1cbaca68dd2e6c39797dd35c82a932460fecb5816867b8f25aca2ba1097","observation_id":"45ac5d74-42db-4e3a-a010-3d9c05bda37c","resolution":{"observed_at":"2026-08-10T13:53:35.472988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:35.451509Z","title":"Managing power grids through topology actions: A comparative study between advanced rule-based and reinforcement learning agents,","venue":null,"work_id":"b44f8c35-7d96-4758-b90c-818e799b9c13","year":2023},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.695737Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:c1bb1f71d8175b322d6d27b079333ba249e19f6d18b9a65efbdf493133f3bbf2","observation_id":"ad8a612d-68e1-47f2-943d-0b1df2931dd9","resolution":{"observed_at":"2026-08-10T13:53:35.456155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.07339","last_updated":"2020-03-16T17:21:35Z","snapshot_observed_at":"2026-08-10T05:37:34.169205Z","submitted_at":"2020-03-16T17:21:35Z","title":"Reinforcement Learning for Electricity Network Operation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.07339","snapshot_observed_at":"2026-08-10T13:53:33.700386Z","title":"Reinforce- ment learning for electricity network operation,","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.700386Z"},"links":{"cited_paper":"/paper/2003.07339","citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:bacbf32401049377408e1c927f9e81bdc4913e0f1f2b6753f462583794089fbc","observation_id":"d8146746-3090-40b0-9f06-342aa134a052","resolution":{"observed_at":"2026-08-10T13:53:33.700386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:35.436971Z","title":"Learning to run a power network challenge: a retrospective analysis,","venue":null,"work_id":"acdd468b-d9cc-47b8-831f-e95735dd5ae3","year":2020},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.705414Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:d0fb26fd6fa1c277a85dfe6434cc226a182efe60bfc8b983790a3cee5ff7bc7e","observation_id":"4f254533-7a3d-42fe-bd03-4447ea79e9fa","resolution":{"observed_at":"2026-08-10T13:53:35.441756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:35.330844Z","title":"Learning to run a power network with trust,","venue":null,"work_id":"50bdf8c8-b437-4d94-bc32-e81736913277","year":2022},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.709953Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:61bfaf1c08f764708302f43d9208d47f1ef95ce09e8dfef4d9ea1af80e8116d6","observation_id":"5d7cc6db-2acc-492c-bcec-8819aeb69371","resolution":{"observed_at":"2026-08-10T13:53:35.397170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:35.217484Z","title":"Ai-based autonomous line flow control via topology adjustment for maximizing time-series atcs,","venue":null,"work_id":"a67189cd-0aed-415a-81e3-c970136e53c0","year":2020},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.714635Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:7c44739f650eadaaf8643dcfa3a100994b2c324ab9ca418a490724487db42aca","observation_id":"782c4edd-383d-46ba-93d1-5753af442e7d","resolution":{"observed_at":"2026-08-10T13:53:35.258638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:35.091638Z","title":"Winning the l2rpn challenge: Power grid management via semi-markov afterstate actor- critic,","venue":null,"work_id":"031224d1-00e4-4613-9755-4ed115aee35d","year":2020},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.778304Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:59ed91bcaf85a233361f66a7d05322541410e44fa0296c41ad1602fb88952976","observation_id":"9242b1b8-7480-4248-b716-18202c6a82b4","resolution":{"observed_at":"2026-08-10T13:53:35.149709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:34.982858Z","title":"Exploring grid topology reconfiguration using a simple deep reinforce- ment learning approach,","venue":null,"work_id":"922567e9-c329-4108-b704-e81ff4e86aff","year":2021},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.847562Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:1756422667d0adc4253b8130d3e4163c9c13ab7c9733de18bc2d6d5c8cc2104b","observation_id":"dc82322a-8cb9-4061-82b2-8f00c0bb1329","resolution":{"observed_at":"2026-08-10T13:53:35.037571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:34.967713Z","title":"Powrl: A reinforcement learning framework for robust management of power networks,","venue":null,"work_id":"6fed178e-c185-4a4d-bf81-1931dc2837ef","year":2023},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.864469Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:51c79026ece6fbb9c23de4196871d780910fb1c0d276e961440986d2f9375781","observation_id":"93284dac-bc70-4e45-a775-2216fc2bae8a","resolution":{"observed_at":"2026-08-10T13:53:34.972759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05612","last_updated":"2022-11-10T14:39:28Z","snapshot_observed_at":"2026-07-06T14:16:44.567536Z","submitted_at":"2022-11-10T14:39:28Z","title":"Power Grid Congestion Management via Topology Optimization with AlphaZero","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05612","snapshot_observed_at":"2026-08-10T13:53:33.869575Z","title":"Power grid congestion management via topology optimization with alphazero,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.869575Z"},"links":{"cited_paper":"/paper/2211.05612","citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:c2002ae6c8df27f4b7f416ea1c33b5666ec1262590d29167a0828c2179f4317b","observation_id":"85fa4237-b0bb-41fc-bf7c-df3348101712","resolution":{"observed_at":"2026-08-10T13:53:33.869575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:34.953605Z","title":"Curriculum based reinforcement learning of grid topology controllers to prevent thermal cascading,","venue":null,"work_id":"871121ab-ab4a-44dc-9964-55b51d10b34e","year":2022},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.874684Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:97d5672e7cbacd7f4a77abb7596ed0cd36b4f24be707723b7b4ff8f452d0e16f","observation_id":"d2c6f519-66d9-488e-a420-a546ede0e34b","resolution":{"observed_at":"2026-08-10T13:53:34.957850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:34.937727Z","title":"A hybrid curriculum learning and tree search approach for network topology control,","venue":null,"work_id":"95878acb-954b-4851-acfe-53ba364ad44c","year":2025},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.878790Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:87af2c27c7dddf39a82da1a6a58ece535ebc2cc3c539d176a5cdd6be66b7aa71","observation_id":"8e71c0cc-e032-4190-ad55-ed0a4935b01b","resolution":{"observed_at":"2026-08-10T13:53:34.943330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:34.906744Z","title":"Hierarchical reinforcement learning for power network topology control","venue":null,"work_id":"b1e0ff3f-709c-4b55-9fbc-7bd765913445","year":null},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.882707Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:df72ae4c2886e010aa5650a1485508673bfff90041736da6b05879f16d942faa","observation_id":"02560c27-8614-4b52-93a5-68c55871f904","resolution":{"observed_at":"2026-08-10T13:53:34.926350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:34.850877Z","title":"Multi-agent reinforcement learning for power grid topology optimization","venue":null,"work_id":"93174dc8-4b8a-474f-acc1-d3d315679a63","year":null},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.923381Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:1c8d1e59f15fafe62916386d68c23a17637df57de3a7dcd7d3932aee9e8e869c","observation_id":"9c561920-a8e8-4341-946d-d3ee05265d9f","resolution":{"observed_at":"2026-08-10T13:53:34.877748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:34.831740Z","title":"Reward design for intelligent deep reinforce- ment learning based power flow control using topology optimization,","venue":null,"work_id":"914444c0-bbba-467a-941b-9a6da0910852","year":2024},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:33.995998Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:5e4b5b3ec7594458880b6e75f000c9dd82f9d97ac942e5b461d4a3cfc805e947","observation_id":"64a44615-a5ef-4750-819b-d3e941100de1","resolution":{"observed_at":"2026-08-10T13:53:34.837565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-10T13:53:34.085345Z","title":"Prox- imal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:34.085345Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:a2cf36f3f4deea6b4f90325dea3df681e67adb5e0cf621ab586ddae670e3a8f7","observation_id":"e8c3e0d5-0fdd-43dd-b769-9a1d5bf15db7","resolution":{"observed_at":"2026-08-10T13:53:34.085345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:34.624937Z","title":"A toolkit for reliable benchmarking and research in multi-objective reinforcement learning,","venue":null,"work_id":"c8ea18a5-b5b1-46ba-af71-38d20241f839","year":2024},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:34.090320Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:c3210db3f81c82bec02651c1b44c16052d33a725993251e18271ceeb25839a1b","observation_id":"f8b691e3-393e-469e-90bd-68f2e9938c4c","resolution":{"observed_at":"2026-08-10T13:53:34.721398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02707","last_updated":"2016-10-09T19:08:36Z","snapshot_observed_at":"2026-07-06T05:13:56.737171Z","submitted_at":"2016-10-09T19:08:36Z","title":"Multi-Objective Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.02707","snapshot_observed_at":"2026-08-10T13:53:34.095082Z","title":"Multi-objective deep reinforcement learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:34.095082Z"},"links":{"cited_paper":"/paper/1610.02707","citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:e417296b25c5826dcacfcfbb8625ad68e2d05011c101cfbbae0d985243e5ad3e","observation_id":"d3b76642-729f-4562-81eb-d37efa0b3a61","resolution":{"observed_at":"2026-08-10T13:53:34.095082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:34.609547Z","title":"A practical guide to multi- objective reinforcement learning and planning,","venue":null,"work_id":"06e8ba24-bfb2-4c10-9790-b5612d3f2d95","year":2022},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:34.099910Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:ed5f0477dadf23d8d73b105673d6b4016e0da7c09fb2516c820dae97c47080f9","observation_id":"cf3c8c74-4a5e-401e-bd2a-7ddfdf1127c5","resolution":{"observed_at":"2026-08-10T13:53:34.614819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:34.559222Z","title":"Grid2op,","venue":null,"work_id":"d813a678-659b-4744-b107-e695b01ac545","year":2020},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:34.104480Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:8d5e763b0f852d10b019181aae74f9bb371087a5d76751a112088acfede8912d","observation_id":"d5fe20b2-b884-49fc-bec0-6a2bbfa4e294","resolution":{"observed_at":"2026-08-10T13:53:34.599405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:34.400317Z","title":"Multi-objective decision-theoretic planning,","venue":null,"work_id":"9268aed0-1fba-44c2-b050-30bb9b74b124","year":2016},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:34.109384Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:09e580f470de207c280cecb6eca89656741ce27e11575b15eaad116ae761107e","observation_id":"e9667b8b-37cf-472f-b715-37119939d02f","resolution":{"observed_at":"2026-08-10T13:53:34.477076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:34.113367Z","title":"DelftBlue Supercomputer (Phase 2),","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:34.113367Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:e29d47a8b22ff53e3a1253bca4343e286948caa414d67d6f38535f786c9bb17b","observation_id":"34ac212e-7838-4d01-9aac-32f1501dd167","resolution":{"observed_at":"2026-08-10T13:53:34.113367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T13:53:34.210219Z","title":"Implementation of multi-objective reinforcement learning for power grid topology control,","venue":null,"work_id":"afa0e476-a712-4d75-849e-ba8c7e601357","year":2025},"citing_paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T13:53:34.118084Z"},"links":{"citing_paper":"/paper/2502.00040"},"observation_digest":"sha256:4f32b15c97a52a528605e81397840794c90fb80d48b049f987607d63078c1468","observation_id":"65bba634-3d78-462f-b494-a1f58703458a","resolution":{"observed_at":"2026-08-10T13:53:34.254296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.00040","last_updated":"2025-05-01T13:45:05Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T13:47:27.374533Z","submitted_at":"2025-01-27T12:23:03Z","title":"Multi-Objective Reinforcement Learning for Power Grid Topology Control"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2502.00040."}