{"as_of":"2026-08-09T17:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d69de7e33cd2bdb24df2fc025dafcd94f3e228af0212cd633f65381fdb1cc26c","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:01:07.763959Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T19:06:08.261216Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T22:17:25.890997Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"cited_work":{"arxiv_id":"2506.04291","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04291","snapshot_observed_at":"2026-07-02T22:17:25.890997Z","title":"Wenhan Xu, Jiashuo Jiang, Lei Deng, and Danny Hin-Kwok Tsang","venue":null,"work_id":"213062aa-544e-4b07-bc16-55e8242d8c7b","year":null},"citing_paper":{"arxiv_id":"2606.08452","last_updated":"2026-06-07T04:51:32Z","snapshot_observed_at":"2026-08-06T04:01:29.728351Z","submitted_at":"2026-06-07T04:51:32Z","title":"Theoretical Foundations of Continual Learning via Drift-Plus-Penalty","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T19:06:08.261216Z"},"links":{"cited_paper":"/paper/2506.04291","citing_paper":"/paper/2606.08452"},"observation_digest":"sha256:42643825927fd53a7f3e09f5077a827c19bcbd18248be50be5cf51f7a3639d75","observation_id":"f1b1b228-a3fe-492e-a223-d9211459a611","resolution":{"observed_at":"2026-07-02T22:17:25.892783Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04291/citation-record","integrity":"/paper/2506.04291/integrity","json":"/paper/2506.04291/citation-record.json","paper":"/paper/2506.04291"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:12.023634Z","title":"Distributed Lyapunov drift-plus-penalty routing for wifi mesh networks with adaptive penalty weight,","venue":null,"work_id":"9d3641b0-ebdb-4447-ac9b-b50eae0be87b","year":2012},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.323643Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:b7fc6ff41dd455669d0c914b6eb0fd1f4be856b0aa0643ac9c1fb6bf5d76a7dd","observation_id":"3158a2da-e0a7-439d-9921-3e4b1910c18b","resolution":{"observed_at":"2026-08-07T11:01:12.117028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:11.845362Z","title":"Lyapunov optimized resource management for multiuser mobile video streaming,","venue":null,"work_id":"4cbb7e16-60f0-45eb-b0eb-b9769fe27d23","year":2018},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.348003Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:81b0a106a528d4dab8027051013e84fdc502558b03786d6bd5928c8c08ba9942","observation_id":"7f4d71af-add1-4464-a895-de3cbb72019a","resolution":{"observed_at":"2026-08-07T11:01:11.943084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:11.693307Z","title":"Lyapunov optimization framework for 5G mobile nodes with multi-homing,","venue":null,"work_id":"bcce2648-6de9-4c58-b19e-ebe5c6cce7c0","year":2016},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.374650Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:f2cf0aff6360ab012c8f3f870fc90a60479e2ae06d52071ec44c4835c7d4b321","observation_id":"02a61fff-48a5-4775-be65-be9b6cd01d9d","resolution":{"observed_at":"2026-08-07T11:01:11.765546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:11.528620Z","title":"On the convergence time of the drift-plus- penalty algorithm for strongly convex programs,","venue":null,"work_id":"ed1e5d77-51f6-49f9-9826-e38f659f108a","year":2015},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.405104Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:836f4d5c410e25ce114db6ffb1aa029d9279b4acc54f5e9e3a35bf5669cb3276","observation_id":"dd432814-721d-4b28-b977-35b93c37a764","resolution":{"observed_at":"2026-08-07T11:01:11.607650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:11.354585Z","title":"Dynamic resource allocation in metro elastic optical networks using Lyapunov drift optimization,","venue":null,"work_id":"8ac64e2a-c25d-4c45-98cd-614f43c39bfa","year":2019},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.424819Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:2ed2b51932da0d4f644ccdfb1790f17fd1413b6406834728001a10863ef45258","observation_id":"d931f671-c29a-4ced-beb1-67eb10e8267f","resolution":{"observed_at":"2026-08-07T11:01:11.443356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:11.194850Z","title":"Neely,Stochastic network optimization with application to commu- nication and queueing systems","venue":null,"work_id":"1adca41b-a970-4618-a233-9a253d4c7490","year":2022},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.442024Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:f1f5dbbe98053b568f2fa7dbc6d0f001e2cb41e1370399edeb71435582a8c340","observation_id":"a15c32da-1c38-4c53-bd46-0d05946ae1a2","resolution":{"observed_at":"2026-08-07T11:01:11.266248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:11.021238Z","title":"On the optimality of greedy policies in dynamic matching,","venue":null,"work_id":"87df0018-7bf7-44e6-8899-ce01d83da5bb","year":2025},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.460847Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:f8e8b378fcae803515582ec6459763631594aa3d5c9c6f09b5efaaeb0e1739bd","observation_id":"e341be66-e734-4a70-b5c5-8dc7efcb74a1","resolution":{"observed_at":"2026-08-07T11:01:11.112886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:10.858810Z","title":"Deep learning for channel tracking in IRS-assisted UA V communication systems,","venue":null,"work_id":"e5c4e561-7d52-481b-b58c-7d162f43d6e0","year":2022},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.476628Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:981ba7dbc531301c7a9d3910dd650196e7eedb45d7bd5a58c5b2a0ad19a25ba0","observation_id":"94f6d505-d3f3-4377-8fc6-99c74b34faa3","resolution":{"observed_at":"2026-08-07T11:01:10.936179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:10.701290Z","title":"Lyapunov-guided deep reinforcement learning for stable online computation offloading in mobile-edge computing networks,","venue":null,"work_id":"5ee650a7-7708-4dc6-b0c6-7cbd1b7cd568","year":2021},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.495553Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:4bc277d87afcebc2e6c40c0e1793009e23a92441d981923d34a0eaebda0b7766","observation_id":"a3f58c3a-a934-4824-aa8a-a4abb3091187","resolution":{"observed_at":"2026-08-07T11:01:10.770761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:10.496663Z","title":"Multi-agent deep reinforcement learning for computation offloading and interference coordination in small cell networks,","venue":null,"work_id":"42b1b825-4360-4542-8c1e-905a851c367f","year":2021},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.514484Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:1ecedaadab19b56c465ec55dab7a358448cb7013be6ae8e1715134170f8d9a85","observation_id":"c407d6cb-4496-444b-9b3a-e3020149f66b","resolution":{"observed_at":"2026-08-07T11:01:10.589231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:06.535745Z","title":"Neely,Stochastic network optimization with application to commu- nication and queueing systems","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.535745Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:4fe5de00adb556d9a67a25ebfde25e2422ec70e59caf6296cb13d018145a40fe","observation_id":"ce9eb58e-9107-4cd8-b330-6889f4045a96","resolution":{"observed_at":"2026-08-07T11:01:06.535745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:10.265655Z","title":"When Lyapunov drift meets DRL: Energy efficient resource allocation for IoT data collecting,","venue":null,"work_id":"a133f0d7-c7d5-4886-a4d0-5e15fb8a5713","year":2023},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.577748Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:3fcdd04f47ebbfdcfe16b5f2a7c24473b3845ecd597fafc61f81b06d9abf9870","observation_id":"af631270-0a47-4902-9fc3-13dd05401dda","resolution":{"observed_at":"2026-08-07T11:01:10.363765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:10.079078Z","title":"Lyapunov-guided resource allocation and task scheduling for edge computing cognitive radio networks via deep reinforcement learning,","venue":null,"work_id":"643792bf-f918-4480-8b2a-ab902bae9b92","year":2025},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.602334Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:4142631e307214f557ff7e9e0f17a750b157450a6c8cb359e2afac8fe9cb6acc","observation_id":"a30643d8-fc0b-4926-a998-bd7906edca31","resolution":{"observed_at":"2026-08-07T11:01:10.166582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:09.912420Z","title":"Lyapunov drift-plus-penalty optimization for queues with finite capacity,","venue":null,"work_id":"a35fd17f-0fb3-4e32-8914-f8ea3a9fc7ea","year":2020},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.631966Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:b37b13e87ebc0de4adfe0e10edc7679f09295f281869afdf66ea65cfaa5a8d1e","observation_id":"6472dff7-fc97-4787-85b1-781bfd2dc161","resolution":{"observed_at":"2026-08-07T11:01:09.989110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:09.777479Z","title":"Joint task offloading and resource allocation for energy-constrained mobile edge computing,","venue":null,"work_id":"8973917e-4f1b-40a2-b079-beb1b5adda4b","year":2022},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.664035Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:77713555d4d973a1c2f88bf2e366b16730d7c3c11940ec0256f4440a1f13499c","observation_id":"5903d4ec-2b3f-49fd-b648-e156eefe3754","resolution":{"observed_at":"2026-08-07T11:01:09.840118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:09.616149Z","title":"UA V-assisted task offloading in vehicular edge computing networks,","venue":null,"work_id":"fbd22298-2c99-4054-847f-023448ff7aad","year":2023},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.697182Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:cb6eff0de9cb5e505a9e507b26541ee0fe8e224a00cb07c74f8e48804a54d268","observation_id":"83bc2677-7f8a-44d1-830f-abc29cba5d69","resolution":{"observed_at":"2026-08-07T11:01:09.691597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:09.463173Z","title":"Energy-efficient federated edge learning with streaming data: A lyapunov optimization approach,","venue":null,"work_id":"786c364e-6bd0-4cb3-a0e7-51d78adf98a9","year":2024},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.727727Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:1d0ec56ab74f5f3623d6b8f619a4f6eb0405951344aeb71d05132e571702fe4c","observation_id":"711865ac-568a-4862-85e1-058120b0d140","resolution":{"observed_at":"2026-08-07T11:01:09.519959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:09.311978Z","title":"Profit maxi- mization of independent task offloading in MEC-enabled 5G internet of vehicles,","venue":null,"work_id":"8f4e0e1a-5693-4e8c-910f-4e761426b48e","year":2024},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.776689Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:eb17ccc8c5e45e32c7edde41789f74ca1268ecb63ce207128def97105d9dd195","observation_id":"6c985a2f-3c2e-4d63-a0c7-4630dc8e8a13","resolution":{"observed_at":"2026-08-07T11:01:09.390067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:09.181976Z","title":"An online rein- forcement learning-based energy management strategy for microgrids with centralized control,","venue":null,"work_id":"9e78ede7-8716-467e-9c87-a8bbea5a92bc","year":2024},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.878338Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:68fa2865bc7267fc9c20b560142f1e3d9b70f02d618ea128856d4a67d1fac58c","observation_id":"22f6739b-4a13-470a-a69c-8d94dcd869b0","resolution":{"observed_at":"2026-08-07T11:01:09.250458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:09.059723Z","title":"Offline meta- reinforcement learning for active pantograph control in high-speed railways,","venue":null,"work_id":"8f3e1d5a-c375-4b9e-a906-7ec304267ed3","year":2024},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:06.982304Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:a686794cf30f954b91b55cbf02401f7f1be7098abb83215c2d80745dde7e7fa3","observation_id":"412d03e4-1991-428c-a500-bee564655913","resolution":{"observed_at":"2026-08-07T11:01:09.123785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.938583Z","title":"Survey on large language model-enhanced reinforcement learning: Concept, taxonomy, and methods,","venue":null,"work_id":"762aae3a-1220-453b-9088-2ea73c0ec63c","year":2024},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:07.065216Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:3957405b3d767536ab1be1a3805460e8d15c2567d607222f9e9374d047cdace6","observation_id":"6d804eaf-b921-4610-933c-6a4a2169b5cb","resolution":{"observed_at":"2026-08-07T11:01:09.002053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.805552Z","title":"Developments in image processing using deep learning and reinforcement learning,","venue":null,"work_id":"d265f628-77bd-4a91-939e-2b49daba3b7f","year":2023},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:07.144477Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:e63fdc88cf25360379a1c76c85ea5561d258ab253cc55235fb9fbc60e9b50492","observation_id":"53137d09-bee3-4958-aa30-8210f825c9b8","resolution":{"observed_at":"2026-08-07T11:01:08.870249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.668298Z","title":"Maximum entropy reinforcement learn- ing in two-player perfect information games,","venue":null,"work_id":"aecf4ac4-25e6-4033-b879-3e751f65af19","year":2021},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:07.262197Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:33d8360cfa9742057624e8848992a7c03d3b1d30da4daa920c75a6a28e35c9c1","observation_id":"680bba6e-828f-4048-8281-57e8799b8362","resolution":{"observed_at":"2026-08-07T11:01:08.733731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.542483Z","title":"Deep reinforcement learning for stochastic computation offloading in digital twin networks,","venue":null,"work_id":"2f1e78b1-1666-43d2-9136-1a4e992d5de0","year":2020},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:07.339429Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:7f014c548eb15f1384294675e6c183022fff8d1d2df336e630ebd60413d8cfcb","observation_id":"267f8b6f-1ad6-417c-a349-9cf0d5ee5c7f","resolution":{"observed_at":"2026-08-07T11:01:08.606839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.409203Z","title":"Learning-based context-aware resource allocation for edge-computing-empowered industrial IoT,","venue":null,"work_id":"af1d2431-a386-4e5f-8b5f-dbfc094eba6f","year":2019},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:07.462947Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:5576e0dd8f1eb1c00ddb221968dca2ed5679c641c3aca345eb755625144f7f68","observation_id":"7544f824-5bd4-4ac1-b54f-30113757517d","resolution":{"observed_at":"2026-08-07T11:01:08.471819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.271116Z","title":"Predictable wireless networked scheduling for bridging hybrid time-sensitive and real-time services,","venue":null,"work_id":"80983f35-2a6a-4eb6-8f15-f82bacd19c55","year":2024},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:07.572313Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:0204a4e44d15f6f615abb3bdcc79a97bf5b5f627153343c36a2cf72a5dd0de81","observation_id":"ce2291f5-3dab-4953-b7f9-7660edd81e0c","resolution":{"observed_at":"2026-08-07T11:01:08.338994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:08.149811Z","title":"Lyapunov optimization based mobile edge computing for internet of vehicles systems,","venue":null,"work_id":"4c7e1d05-4ef4-4348-9442-3c3d3b206ecc","year":2022},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:07.597884Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:6de5a2394ac2a7fb9b9511b7e33cbc63fa8846d7ec04380e91a11c243e9de97a","observation_id":"3b55bda4-7f0d-425c-b83a-9ed6ce38abb7","resolution":{"observed_at":"2026-08-07T11:01:08.207066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.995810Z","title":"Enhancing fog computing through intelligent reflecting surface assistance: A Lyapunov driven reinforcement learning approach,","venue":null,"work_id":"0e9f02f2-b240-4b99-88a4-359499fa7a12","year":2024},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:07.673486Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:1e566b6fdd5cc3ad7e0a39ea6104e4aaed5a1d6988c2c5deb47d31d1bae73cf4","observation_id":"596603da-452c-40b0-a9bf-00467693723a","resolution":{"observed_at":"2026-08-07T11:01:08.078244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:01:07.873795Z","title":"Energy-latency aware intelligent reflecting surface aided multi-cell mobile edge computing,","venue":null,"work_id":"7a5e14f9-8a02-4cf5-926c-256d864153ed","year":2023},"citing_paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:01:07.763959Z"},"links":{"citing_paper":"/paper/2506.04291"},"observation_digest":"sha256:b2c0783f420e6eb6db87eeb3155967e9e091e60aea23b4e45db2be69b99b1b55","observation_id":"915105e3-3fdf-4f08-b4ff-63306c3414d7","resolution":{"observed_at":"2026-08-07T11:01:07.902668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.04291","last_updated":"2025-06-04T10:56:24Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T10:52:14.179448Z","submitted_at":"2025-06-04T10:56:24Z","title":"A Lyapunov Drift-Plus-Penalty Method Tailored for Reinforcement Learning with Queue Stability"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":0,"verified_fuzzy":28},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 1 inbound Pith citation observation for arXiv:2506.04291."}