{"as_of":"2026-08-13T17:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a8a31b8fa84811963b81b248a9e9d1034477668c366a82520f5199b48388be2c","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T01:05:48.492775Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.24947/citation-record","integrity":"/paper/2606.24947/integrity","json":"/paper/2606.24947/citation-record.json","paper":"/paper/2606.24947"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Digitalisation and Energy,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:17a7595654bc7470d2bc8b4da1972cc7bc8f912f8c1919fd5eb0bad2fd715527","observation_id":"70e4fc51-a727-4b06-9232-088bc930c7fc","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Aggregated feasible active power region for distributed energy resources with a distributionally robust joint probabilistic guarantee,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:64ff2dca23c4f4c22089a2bbdaa39b9fc6cad35762dd323705c73aae135c4aab","observation_id":"fd3c8733-a858-4e07-ac87-c490c6570f38","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Incorporating charger efficiency into electric vehicle charging optimization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:a6f0e374fbf68b6fedbc6b5d10ff0af2e362c9993f87277df533c929d9496c82","observation_id":"a15216cb-927c-47ba-81f7-0210b168554a","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"A control framework to enable a commercial building hvac system for energy and regulation market signal tracking,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:d2f2b0c608fe8347dbea9a40a2f8f3f133dda30ea139af1972d40d3d07ea6ec9","observation_id":"df18dfc9-c8b2-45c0-99f6-6538f4e0c741","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Deep reinforcement learning for power system applications: An overview,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:a12e08e82763466d850250b7120e44bce1c59e94bb9564fb23e634c883b7dcb9","observation_id":"dde30f03-5d2b-450c-b822-5740c6790903","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Deep reinforcement learning control of electric vehicle charging in the presence of photovoltaic generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:fe37d042bed4c02794b921cac9f9bcbe423e63718a28a7840962f7b69e41f608","observation_id":"2d21464c-b74e-498d-a9ef-88183d71678f","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"An uncertainty-aware deep reinforcement learning framework for residential air conditioning energy management,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:e60fbdd1f588f94d6d073dbbc062a99e79607bb7dd7d4ab53406ec695ae4ede4","observation_id":"8d43b838-059e-4cb5-8280-7b5c269376bd","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"On-line building energy optimization using deep reinforcement learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:a9683657643c1095119ca747227eb22fa740dc920722499a1d63580082f9c669","observation_id":"85a1a14a-ec9c-49fa-82bd-43013f449188","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Deep reinforcement learning for smart home energy management,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:d00c34f5ca450c1a8b8f8b9e8f95d4c8249898df999e2967c9bdb9e592a91fea","observation_id":"b18f21ae-c632-47b9-8fbc-2d0ca6e2c8f5","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Secure energy management of multi-energy microgrid: A physical-informed safe reinforcement learning approach,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:b2b418828c637ec3617cf3b40444adbaa6698b19280d70f4ea537019419b8b9a","observation_id":"4a91145f-93b5-4d41-b206-91a492671213","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Forecasting error-aware optimal dispatch of wind-storage integrated power systems: A soft-actor-critic deep reinforcement learning approach,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:7abdc8fd43dd200307784d77a654b9e8afe247b8971dd57cfe617f16a790080a","observation_id":"94c1cc31-1dc0-412a-89dc-ffa5637f68c2","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06452","last_updated":"2024-02-19T14:39:07Z","snapshot_observed_at":"2026-08-13T16:47:08.208696Z","submitted_at":"2023-10-10T09:25:44Z","title":"Understanding the Effects of RLHF on LLM Generalisation and Diversity","version":3},"cited_work":{"arxiv_id":"2310.06452","doi":"10.48550/arxiv.2310.06452","metadata_source":"pith","pith_arxiv_id":"2310.06452","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Understanding the Effects of RLHF on LLM Generalisation and Diversity","venue":"cs.LG","work_id":"13d47639-3500-414f-b6ea-1f277577ad3b","year":2023},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"cited_paper":"/paper/2310.06452","citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:ba210afb8f877773f3506da588a7ffc9174a5e15dbd5a4201d786b46188657ef","observation_id":"5d57eb6b-fa60-4771-adba-d0c003d8d1f3","resolution":{"observed_at":"2026-07-04T15:59:57.320099Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":"2204.05862","doi":"10.1016/j.respol.2005.01.014","metadata_source":"pith","pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","venue":"cs.CL","work_id":"a1f2574b-a899-4713-be60-c87ba332656c","year":2022},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:2c1cd53051699073efbd1a00ce3991f5771772efb23439c753f038f5aebebe37","observation_id":"6130462c-fb42-4510-806b-894ef3e45a9f","resolution":{"observed_at":"2026-07-04T15:59:57.314575Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Multiagent imitation learning-based energy management of a microgrid with hybrid energy storage and real-time pricing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:590f224003f2057c247b8c48c54da83127b29fd99e02bc1952d6ef9bd71a69ec","observation_id":"45a6db53-146b-47ce-a01a-e93b5243c3f5","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Online optimal power scheduling of a microgrid via imitation learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:03cdaaeecc41a082cc6f68e567be966d52b4eb697656a45a30931d5865ecba88","observation_id":"f510a4b6-b79e-4d7d-8b10-63f394d8dbdf","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Scalable multi- agent reinforcement learning for distributed control of residential energy flexibility,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:96b6ccffbfcb87c7886e6de00c413f4671576a9b2b2aabbf07706624ab725024","observation_id":"1357c339-1ec3-47cc-8a14-53b16d0b8263","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Real-time power scheduling through reinforcement learning from demonstrations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:ad2b55a01d014eb64e2909bb9da447c13c0ac854330275b9f9d686dba4bd5737","observation_id":"9dac78d1-7454-4c9b-aa9c-d42375a1007d","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Cal-ql: Calibrated offline rl pre-training for efficient online fine-tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:52e09d4e0e1073362926b0b94ef757f229acb27b583a4add69d1dc5f6c1a6c1e","observation_id":"36b88c80-8710-4804-b860-9d0f0ddd64c2","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08387","last_updated":"2025-07-11T08:00:12Z","snapshot_observed_at":"2026-08-11T13:36:57.357284Z","submitted_at":"2025-07-11T08:00:12Z","title":"Online Pre-Training for Offline-to-Online Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.08387","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.08387","snapshot_observed_at":"2026-07-04T15:59:57.315756Z","title":"Online pre-training for offline-to-online reinforcement learning.arXiv preprint arXiv:2507.08387","venue":null,"work_id":"4aa34efa-33c6-4610-9315-ec1177ef3920","year":2025},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"cited_paper":"/paper/2507.08387","citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:5f438f80bf71c0cd4053c41480ac9bbb461626c53fa4db2821153d395a930023","observation_id":"f2bddfb0-1199-487d-93f3-8229f9b8363b","resolution":{"observed_at":"2026-07-04T15:59:57.317358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Model pre- dictive control for distributed microgrid battery energy storage systems,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:f51f36822e2efa5702bf0c48a73107ec8df4d5b68378be5cfaeeda91399aafb4","observation_id":"9b2ccf79-3bfb-4bc7-8268-a200b119261b","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Aggregate flexibility of thermostatically controlled loads,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:74875220b3a3cbcac0b8f0036b030da4facd388614e6ee771233261f9dce7d9c","observation_id":"df870a43-d6e5-41ba-aa85-cba7539385a8","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:6bff1821391757417bbf64081515b936ac42f819597caed3d386dd0b748a21f8","observation_id":"16a4624c-0f56-4090-9c24-c56bb628556d","resolution":{"observed_at":"2026-07-04T15:59:57.322513Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"The impact of future heat demand pathways on the economics of low carbon heating systems,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:10335f187580e1f291c4c94478e1d2d7be61e82ebd0ecbf3a145097036a81b6f","observation_id":"bd971728-aae7-450b-ba1b-a2c9e325c034","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"The modern-era retrospective analysis for research and applications, version 2 (merra-2),","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:8310930dd7e737fdce724f7906096c4c3d268a8efd53d7a05fceb43855170fde","observation_id":"b3e6857e-3170-4806-b4e1-e99515e7ba75","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Optimal scheduling for a multi-energy microgrid by a soft actor-critic deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:cdf5f7440212544c06336bed40e3ada96baff4b5c09506b56d92872253844a8c","observation_id":"32bd213c-abab-4f83-a7cd-514b9ceca6b4","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:05:48.492775Z","title":"Scenario reduction algorithms in stochastic programming,","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T01:05:48.492775Z"},"links":{"citing_paper":"/paper/2606.24947"},"observation_digest":"sha256:050fa7dc821ffcaa89d3f6792fedf5597e9e7e68c053962136b672f738a9a5be","observation_id":"e928630e-044d-40a6-b2cd-90ff42d983c5","resolution":{"observed_at":"2026-06-26T01:05:48.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.24947","last_updated":"2026-06-23T07:17:58Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T20:33:42.806752Z","submitted_at":"2026-06-23T07:17:58Z","title":"Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2606.24947."}