Pith. sign in

Paper Citation Record · LEDGER

Asynchronous Methods for Deep Reinforcement Learning

As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 75 inbound Pith citation observations for arXiv:1602.01783.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
1602.01783 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 75 of 75 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-23T06:30:58.430688+00:00

measured 75 of 75 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-16T12:40:31.219392Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-05T02:28:24.338817Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

1690
pith, observed 2026-08-05T02:28:24.338817Z

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 7d34af5c-57b3-4bb8-9b88-46e76156235c · inbound

OpenAI Gym cites this paper.

OpenAI Gym Asynchronous Methods for Deep Reinforcement Learning

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-05-11T19:49:39.040735Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-11T19:49:38.960459Z digest=sha256:4117f01811052683447f3573515aba82a44c0dbc91f725bed676aa4d7ce9f892

Observation 696e50c7-cce6-4c80-9ffe-16489702aa79 · inbound

DeepMind Control Suite cites this paper.

DeepMind Control Suite Asynchronous Methods for Deep Reinforcement Learning

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-13T07:44:14.745723Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-13T07:44:14.707183Z digest=sha256:1b721ee418f3bb6b9c46a24c47427acf4e14e1a9b577b842fa333ba66e3c9a23

Observation 7fd0cc43-369f-47b0-9570-f86bcfa0370d · inbound

Planning Robot Motion using Deep Visual Prediction cites this paper.

Planning Robot Motion using Deep Visual Prediction Asynchronous Methods for Deep Reinforcement Learning

Reference 12

Resolution
metadata mismatch
local_arxiv, observed 2026-05-25T17:11:04.468747Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-25T17:07:52.962491Z digest=sha256:4b296afbe03e5ece8d72437bb039f7cc1ecc9faf9e61a299039d8eef0e318541

Observation bd3fc7f1-22af-4456-82eb-e47337075e50 · inbound

Playing Flappy Bird via Asynchronous Advantage Actor Critic Algorithm cites this paper.

Playing Flappy Bird via Asynchronous Advantage Actor Critic Algorithm Asynchronous Methods for Deep Reinforcement Learning

Reference 9

Resolution
verified exact
local_arxiv, observed 2026-05-25T01:45:11.091962Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-25T01:41:09.116967Z digest=sha256:ed6d99542d4bba5ffd60c5f8b7aff7b06679c4fe4203df9009246c6029433006

Observation 3365c85b-6ab5-4066-a609-dd17c2d4e01d · inbound

Learning-based Hamilton-Jacobi-Bellman Methods for Optimal Control cites this paper.

Learning-based Hamilton-Jacobi-Bellman Methods for Optimal Control Asynchronous Methods for Deep Reinforcement Learning

Reference 26

Resolution
verified exact
local_arxiv, observed 2026-05-24T17:09:43.654399Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-24T17:07:07.010918Z digest=sha256:c67bab546363612082ae6afafb774fb91fa2221ce1802948757e14972eb9aa4b

Observation 22c6086b-795c-4bc9-a9db-cc3ab5de304a · inbound

A review on Deep Reinforcement Learning for Fluid Mechanics cites this paper.

A review on Deep Reinforcement Learning for Fluid Mechanics Asynchronous Methods for Deep Reinforcement Learning

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-14T13:55:04.879719Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T13:55:04.879719Z digest=sha256:1c5cb0587d29fdf44d148f5e09654fc0c95fa98865b2ca35b7d9d6cea73a2c2e

Observation 87fd2502-6505-4412-867a-1b9eeb0d9faf · inbound

A Data-Efficient Deep Learning Approach for Deployable Multimodal Social Robots cites this paper.

A Data-Efficient Deep Learning Approach for Deployable Multimodal Social Robots Asynchronous Methods for Deep Reinforcement Learning

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-14T10:49:41.216476Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-14T10:49:41.216476Z digest=sha256:9ffd6216e314f43073bca02ed2e76859c074020a711fe827a7e5959bd3da4029

Observation aaf56b0a-7703-4f52-907e-ec63b8d02bed · inbound

Interactive Machine Comprehension with Information Seeking Agents cites this paper.

Interactive Machine Comprehension with Information Seeking Agents Asynchronous Methods for Deep Reinforcement Learning

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-14T10:46:45.733859Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-14T10:46:45.733859Z digest=sha256:97513e4fd497bc7b25fec1963de89cc3995549a7c1e27bd02b85d6c12d520342

Observation 9ad68b37-3473-49fa-b5ca-106efdd57084 · inbound

LeDeepChef: Deep Reinforcement Learning Agent for Families of Text-Based Games cites this paper.

LeDeepChef: Deep Reinforcement Learning Agent for Families of Text-Based Games Asynchronous Methods for Deep Reinforcement Learning

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-14T05:15:24.499065Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-14T05:15:24.499065Z digest=sha256:e19ec867b57d6d2aae1e9b9ef62dddbc51fa83aca32fe3b592e45ac4921ae5c7

Observation dfa9f271-75b2-4586-9e41-a6c6f4b7cd12 · inbound

Scaling Laws for Transfer cites this paper.

Scaling Laws for Transfer Asynchronous Methods for Deep Reinforcement Learning

Reference 113

Resolution
metadata mismatch
local_arxiv, observed 2026-05-18T00:58:13.798226Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-05-18T00:58:13.116663Z digest=sha256:4ea22230631f45bb9ac6b8d79962d02ecef178bf11264682f75cad3d76945df1

Observation 1f12c442-ffb7-43b8-a65e-425a42d1a472 · inbound

A General Language Assistant as a Laboratory for Alignment cites this paper.

A General Language Assistant as a Laboratory for Alignment Asynchronous Methods for Deep Reinforcement Learning

Reference 155

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T14:22:59.709358Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-05-11T14:22:57.925354Z digest=sha256:115e9fe1681498d46a346a11e2989f39bfb2af10577e5c7f7487475f2195afa4

Observation f8e3bb1e-7f9b-4018-a7b4-4c0c6c0c960e · inbound

Language Models (Mostly) Know What They Know cites this paper.

Language Models (Mostly) Know What They Know Asynchronous Methods for Deep Reinforcement Learning

Reference 232

Resolution
metadata mismatch
arxiv_id, observed 2026-05-10T15:42:47.903225Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-05-10T15:42:47.274448Z digest=sha256:d53f5085940e3f1b3229fd547d3198003f9ef0a26d607a4f387fce8d9564c5b1

Observation 0bb2fa49-ca35-4ddd-ad8e-f5c63a2402fb · inbound

RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback cites this paper.

RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback Asynchronous Methods for Deep Reinforcement Learning

Reference 68

Resolution
verified exact
local_arxiv, observed 2026-05-15T21:32:28.007411Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-05-15T21:32:27.806494Z digest=sha256:2e4c25658dff6b3c4be7fb6cbebe0c96396b9edfd51de96dd5ece71b470cb9c9

Observation 54b7432c-7d0e-4e4f-9e57-d19cca6b0979 · inbound

Training Language Models to Self-Correct via Reinforcement Learning cites this paper.

Training Language Models to Self-Correct via Reinforcement Learning Asynchronous Methods for Deep Reinforcement Learning

Reference 72

Resolution
verified exact
local_arxiv, observed 2026-05-17T12:04:10.523459Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-05-17T12:04:10.210508Z digest=sha256:b5ce1fe2b53115a1da5f690ffbc2fef8a768e3fed837eb58ab7a06ec3c8f2ff9

Observation 99fea828-7ca7-4e2e-a18b-1250c1e0c188 · inbound

Gazing at Rewards: Eye Movements as a Lens into Human and AI Decision-Making in Hybrid Visual Foraging cites this paper.

Gazing at Rewards: Eye Movements as a Lens into Human and AI Decision-Making in Hybrid Visual Foraging Asynchronous Methods for Deep Reinforcement Learning

Reference 90

Resolution
unresolved
no resolver link, observed 2026-08-12T21:02:52.716505Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T21:02:52.716505Z digest=sha256:48f9250fe67776928aaffeec42441b92d9c60a087c54226225bc23e1cf7d12cf

Observation edf825ab-7dd8-48cd-9259-1bc7e99ec9f3 · inbound

Efficient, Low-Regret, Online Reinforcement Learning for Linear MDPs cites this paper.

Efficient, Low-Regret, Online Reinforcement Learning for Linear MDPs Asynchronous Methods for Deep Reinforcement Learning

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-12T19:18:52.613740Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-12T19:18:52.613740Z digest=sha256:71a05e622fb5546ab159e4d76a837d0ae08bfff82af2db4b89053c4ddbbbfa84

Observation 68f71c4d-2e5c-4d02-90fd-9d64c7443265 · inbound

Design And Optimization Of Multi-rendezvous Manoeuvres Based On Reinforcement Learning And Convex Optimization cites this paper.

Design And Optimization Of Multi-rendezvous Manoeuvres Based On Reinforcement Learning And Convex Optimization Asynchronous Methods for Deep Reinforcement Learning

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-12T18:13:49.389644Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:13:49.389644Z digest=sha256:6923d5a429476b42a9d4b207bb8260624ff27bf62352400407007cf73a94149f

Observation 32cf4eb9-3378-41f6-859d-4a9a906e440d · inbound

Reinforcement Learning Enhancing Entanglement for Two-Photon-Driven Rabi Model cites this paper.

Reinforcement Learning Enhancing Entanglement for Two-Photon-Driven Rabi Model Asynchronous Methods for Deep Reinforcement Learning

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-12T13:55:18.247491Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T13:55:18.247491Z digest=sha256:055bf317b2107f7d04e3fab0cdd5caf344870416eb3a4e576ff60c675ae0c9cc

Observation eb1d32b8-4509-494f-8d00-70b0407f7eca · inbound

Unsupervised Event Outlier Detection in Continuous Time cites this paper.

Unsupervised Event Outlier Detection in Continuous Time Asynchronous Methods for Deep Reinforcement Learning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-12T13:14:39.175729Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T13:14:39.175729Z digest=sha256:129381296d5021ee6d748719d165af5d1744bdfaf220f49d534591eaafe2906f

Observation f7db30ff-f74b-4f2a-94b4-919a94b7b585 · inbound

RoboMD: Uncovering Robot Vulnerabilities through Semantic Potential Fields cites this paper.

RoboMD: Uncovering Robot Vulnerabilities through Semantic Potential Fields Asynchronous Methods for Deep Reinforcement Learning

Reference 52

Resolution
verified exact
local_arxiv, observed 2026-05-23T07:52:43.766860Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-23T07:49:37.878395Z digest=sha256:dca22f4c9aaaf7aebcedd3394b5c1ed5a880dbaf5899c72d99afc230f8973f38

Observation 4a386bf2-d15d-4c8d-9099-e68a04421060 · inbound

Scalable Hierarchical Reinforcement Learning for Hyper Scale Multi-Robot Task Planning cites this paper.

Scalable Hierarchical Reinforcement Learning for Hyper Scale Multi-Robot Task Planning Asynchronous Methods for Deep Reinforcement Learning

Reference 34

Resolution
verified exact
local_arxiv, observed 2026-05-23T06:45:28.209245Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-23T06:45:01.088161Z digest=sha256:bb949299da9d9b2db7d0bfed7f7b056e7fb00a73a14e8786485c05a730b64bed

Observation 54af0541-f35f-4461-8bbf-2fc7a6cc3619 · inbound

An Overview and Discussion on Using Large Language Models for Implementation Generation of Solutions to Open-Ended Problems cites this paper.

An Overview and Discussion on Using Large Language Models for Implementation Generation of Solutions to Open-Ended Problems Asynchronous Methods for Deep Reinforcement Learning

Reference 132

Resolution
unresolved
no resolver link, observed 2026-08-10T22:51:52.669280Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:51:52.669280Z digest=sha256:808403cee0e555549aa7316ea0697d63147fc18cd621941fb01c3edc35fae354

Observation 2f2f5828-4238-4372-a018-241c3ad6916c · inbound

A Study of the Efficacy of Generative Flow Networks for Robotics and Machine Fault-Adaptation cites this paper.

A Study of the Efficacy of Generative Flow Networks for Robotics and Machine Fault-Adaptation Asynchronous Methods for Deep Reinforcement Learning

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-10T21:56:24.577130Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T21:56:24.577130Z digest=sha256:14659e63be13529c303a01314e66250974883aa5e041d659a761ca8b6716befd

Observation 5a10a953-c197-4bd2-8f65-696442f513e3 · inbound

FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation cites this paper.

FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation Asynchronous Methods for Deep Reinforcement Learning

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-09T17:31:58.313102Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T17:31:58.313102Z digest=sha256:25fe31d6440006776a7275d05bba8929c6f51bd1207001b466ff7ed3e138f18b

Observation b0c26e35-f012-4f53-8a5c-1ad5fc9620e7 · inbound

TeLL-Drive: Enhancing Autonomous Driving with Teacher LLM-Guided Deep Reinforcement Learning cites this paper.

TeLL-Drive: Enhancing Autonomous Driving with Teacher LLM-Guided Deep Reinforcement Learning Asynchronous Methods for Deep Reinforcement Learning

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-09T15:32:47.787354Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T15:32:47.787354Z digest=sha256:3575c210660c10aa57bfbb20fab6d79751e96f7e9b5a19b48fc6fe759063e90c

Observation a82b35c9-b6df-4fba-8e8f-ad3c66baa1c6 · inbound

KABB: Knowledge-Aware Bayesian Bandits for Dynamic Expert Coordination in Multi-Agent Systems cites this paper.

KABB: Knowledge-Aware Bayesian Bandits for Dynamic Expert Coordination in Multi-Agent Systems Asynchronous Methods for Deep Reinforcement Learning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-08T13:08:22.762086Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-08T13:08:22.762086Z digest=sha256:32595ed7cc0c992ee8c54f0e9c05f9c703b76c88fd5dbb8a930339e249894591

Observation c4c17a51-bb00-45b6-ad81-8d7f197e4ec4 · inbound

Dynamic Reinforcement Learning for Actors cites this paper.

Dynamic Reinforcement Learning for Actors Asynchronous Methods for Deep Reinforcement Learning

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T19:07:25.315321Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T19:07:25.315321Z digest=sha256:d8c948c337ba2ba15da01c18e00cabbdfdcb9119013606f83c28cce08c88d8f0

Observation d2975eba-7edd-418d-bf13-fd4d1096fcb0 · inbound

pix2pockets: Shot Suggestions in 8-Ball Pool from a Single Image in the Wild cites this paper.

pix2pockets: Shot Suggestions in 8-Ball Pool from a Single Image in the Wild Asynchronous Methods for Deep Reinforcement Learning

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-16T12:40:31.219392Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T12:40:31.219392Z digest=sha256:8d9d12ac28ffed36ce98be2481aebe768869ec2638e39b43dad750b8bde8c0fb

Observation 6fcf6ed2-cde1-4d81-866b-802490fe6666 · inbound

Evolutionary Policy Optimization cites this paper.

Evolutionary Policy Optimization Asynchronous Methods for Deep Reinforcement Learning

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-16T12:32:58.807134Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T12:32:58.807134Z digest=sha256:73cf47b76f35878707a48fd64ed820d44ac92b4214f10981d40671971e09617e

Observation ed9d7e56-dc3c-4f0c-908b-fa1d512aee3c · inbound

Multimodal Perception for Goal-oriented Navigation: A Survey cites this paper.

Multimodal Perception for Goal-oriented Navigation: A Survey Asynchronous Methods for Deep Reinforcement Learning

Reference 113

Resolution
unresolved
no resolver link, observed 2026-08-16T11:23:58.569450Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:23:58.569450Z digest=sha256:e7ad0b7499ac112c1b8ada83be3c4313376436f5ec7848c01bf2cbaca2d2774d

Observation 72f032a0-577c-4a5e-9367-3a1db2d3abdf · inbound

Hierarchical Reinforcement Learning in Multi-Goal Spatial Navigation with Autonomous Mobile Robots cites this paper.

Hierarchical Reinforcement Learning in Multi-Goal Spatial Navigation with Autonomous Mobile Robots Asynchronous Methods for Deep Reinforcement Learning

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-16T10:14:06.271633Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T10:14:06.271633Z digest=sha256:36d80989b153383fc3e29b15e6e0c1973e7e225e16bd9cf5137178764aab9ac3

Observation 51c03c50-59b8-4898-a257-0cd29a06d884 · inbound

Towards Human-Centric Autonomous Driving: A Fast-Slow Architecture Integrating Large Language Model Guidance with Reinforcement Learning cites this paper.

Towards Human-Centric Autonomous Driving: A Fast-Slow Architecture Integrating Large Language Model Guidance with Reinforcement Learning Asynchronous Methods for Deep Reinforcement Learning

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-15T22:34:58.371687Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:34:58.371687Z digest=sha256:f40bb6665f9e8aa708d3930687ec03d58a94cea0d1585f03502c4bf2cacf39fb

Observation a1668cc2-f56f-402d-8c0c-05eb98f56aae · inbound

Deep Reinforcement Learning for Power Grid Multi-Stage Cascading Failure Mitigation cites this paper.

Deep Reinforcement Learning for Power Grid Multi-Stage Cascading Failure Mitigation Asynchronous Methods for Deep Reinforcement Learning

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-15T21:46:53.493674Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T21:46:53.493674Z digest=sha256:b2c7a8fdb2c827ccdd91fa9453aca2c8be54d5c9d1e1d86eb79206697024f2f2

Observation fe5691a2-f0ba-4404-87a8-47154d372954 · inbound

Rethinking Agent Design: From Top-Down Workflows to Bottom-Up Skill Evolution cites this paper.

Rethinking Agent Design: From Top-Down Workflows to Bottom-Up Skill Evolution Asynchronous Methods for Deep Reinforcement Learning

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T14:47:33.377782Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:47:33.377782Z digest=sha256:8b89787af62721f097cbf139a04e81f6abd8828ffa55b8e7cb29f27e4420c7ad

Observation ba73ae61-cfb2-491f-9418-3d1843619463 · inbound

Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning cites this paper.

Multi-level Certified Defense Against Poisoning Attacks in Offline Reinforcement Learning Asynchronous Methods for Deep Reinforcement Learning

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-07T13:58:12.489760Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T13:58:12.489760Z digest=sha256:2a53d91d028ed50d8ed910a3ea084f673605c5ace9aded44e03aa3557a8ff19d

Observation 1120b463-225b-4942-965a-2a6283b476b5 · inbound

A Framework for Adversarial Analysis of Decision Support Systems Prior to Deployment cites this paper.

A Framework for Adversarial Analysis of Decision Support Systems Prior to Deployment Asynchronous Methods for Deep Reinforcement Learning

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T13:33:41.814584Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:33:41.814584Z digest=sha256:3ff4589f03cab21a887cf2cf75c0ba9fb51f246605923bbc4f6e75dd1af06bb0

Observation c481c752-34aa-4139-be7e-d5181c79ecf2 · inbound

Adaptive Plane Reformatting for 4D Flow MRI using Deep Reinforcement Learning cites this paper.

Adaptive Plane Reformatting for 4D Flow MRI using Deep Reinforcement Learning Asynchronous Methods for Deep Reinforcement Learning

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T12:06:24.976984Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:06:24.976984Z digest=sha256:a08d48e8492659c9f734a8c4a7a38a2105c809069238c1eb8a63785c7e7985c4

Observation 27a06128-7d5a-4324-83f7-147c16b553a6 · inbound

Solving the Job Shop Scheduling Problem with Graph Neural Networks: A Customizable Reinforcement Learning Environment cites this paper.

Solving the Job Shop Scheduling Problem with Graph Neural Networks: A Customizable Reinforcement Learning Environment Asynchronous Methods for Deep Reinforcement Learning

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T05:10:26.481993Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T05:10:26.481993Z digest=sha256:e62d64678497a720171c445288aa3254e90702761d49a7caa8ee5555f90131f7

Observation 3c73e8e0-a80e-498a-8187-b1edd0ccd205 · inbound

A Novel Indicator for Quantifying and Minimizing Information Utility Loss of Robot Teams cites this paper.

A Novel Indicator for Quantifying and Minimizing Information Utility Loss of Robot Teams Asynchronous Methods for Deep Reinforcement Learning

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-07T00:24:54.163892Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:24:54.163892Z digest=sha256:80fcb1c70305316f96e22b30be749bca9df34e50b627117da117662af556fa56

Observation fd448abc-a1b6-4269-9c39-d23c6934087f · inbound

Neural Polar Decoders for DNA Data Storage cites this paper.

Neural Polar Decoders for DNA Data Storage Asynchronous Methods for Deep Reinforcement Learning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-06T23:35:33.631192Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:35:33.631192Z digest=sha256:266c19ee2234e5efade43e03fe71867a27fa37cb4b19d20548de2bc762a39cec

Observation 433b45d1-7f48-4c61-9f21-ec257892d076 · inbound

RL-Selector: Reinforcement Learning-Guided Data Selection via Redundancy Assessment cites this paper.

RL-Selector: Reinforcement Learning-Guided Data Selection via Redundancy Assessment Asynchronous Methods for Deep Reinforcement Learning

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-06T22:45:59.903971Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:45:59.903971Z digest=sha256:c9291646b9a7969ee8ae51295572ecd4ff82b8ddb0b38f7fa1533a98c9504cc5

Observation 523508df-9e4a-4d47-b649-03f98481f003 · inbound

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems cites this paper.

Reward Balancing Revisited: Enhancing Offline Reinforcement Learning for Recommender Systems Asynchronous Methods for Deep Reinforcement Learning

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T22:14:47.126380Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:14:47.126380Z digest=sha256:56f84668a7491fca4f78524c21333902d0182dd3c3be23d0389c7926e4b71bb2

Observation 7a9254bb-725b-4328-893c-515d8b082723 · inbound

Directly Learning Stock Trading Strategies Through Profit Guided Loss Functions cites this paper.

Directly Learning Stock Trading Strategies Through Profit Guided Loss Functions Asynchronous Methods for Deep Reinforcement Learning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T14:17:11.967228Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T14:17:11.967228Z digest=sha256:d6626969609c938aa7ad4981f84ce89d87b758a7d449c6a1c961cf66a1e7fcf8

Observation 3b64227f-f450-4e22-a94e-ac4bc865b0ab · inbound

Structure-Informed Deep Reinforcement Learning for Inventory Management cites this paper.

Structure-Informed Deep Reinforcement Learning for Inventory Management Asynchronous Methods for Deep Reinforcement Learning

Reference 2016

Resolution
unresolved
no resolver link, observed 2026-08-06T12:12:46.223383Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T12:12:46.223383Z digest=sha256:e2a76fb9fbbe7dd829ac1901017cdca3275b2f6245b1a118f190dd7674b7c946

Observation ca35866d-68cf-4483-ad6f-3c7d73f80369 · inbound

TLE-Based A2C Agent for Terrestrial Coverage Orbital Path Planning cites this paper.

TLE-Based A2C Agent for Terrestrial Coverage Orbital Path Planning Asynchronous Methods for Deep Reinforcement Learning

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-05T20:19:13.333865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T20:19:13.333865Z digest=sha256:560a8a75bd52002afd3117c9ac127b1c1c018a58ea7f3a426719c1f8126eea11

Observation 9827bf37-c490-4fb5-9958-aaabe41af70d · inbound

AdaptiveAE: An Adaptive Exposure Strategy for HDR Capturing in Dynamic Scenes cites this paper.

AdaptiveAE: An Adaptive Exposure Strategy for HDR Capturing in Dynamic Scenes Asynchronous Methods for Deep Reinforcement Learning

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-15T17:19:31.556905Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T17:19:31.556905Z digest=sha256:e886bdf179650e05890fce4ace692a51b7e483313b2e9e4b9d0bd12045a9a246

Observation 4a72d810-2e97-4afb-9b49-a44bb9e202b7 · inbound

Scalable Option Learning in High-Throughput Environments cites this paper.

Scalable Option Learning in High-Throughput Environments Asynchronous Methods for Deep Reinforcement Learning

Reference 42

Resolution
metadata mismatch
local_arxiv, observed 2026-05-18T20:06:49.781218Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-05-18T20:04:58.064472Z digest=sha256:8bdd68703517229915375ea1207cbbd77748e1227d50386dcd65d6527b422971

Observation 5c76b908-f463-42d1-9255-92feef361b61 · inbound

Vehicle-in-Virtual-Environment (VVE) Method for Developing and Evaluating VRU Safety of Connected and Autonomous Driving with Focus on Bicyclist Safety cites this paper.

Vehicle-in-Virtual-Environment (VVE) Method for Developing and Evaluating VRU Safety of Connected and Autonomous Driving with Focus on Bicyclist Safety Asynchronous Methods for Deep Reinforcement Learning

Reference 97

Resolution
unresolved
no resolver link, observed 2026-08-05T13:30:05.954112Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:30:05.954112Z digest=sha256:1bac6001d2e214b9aaa671de0a3fbff17acdc892d558c82bfca243f70cb7d664

Observation fb538c23-f11e-4350-97be-2124acce72db · inbound

Structured AI Decision-Making in Disaster Management cites this paper.

Structured AI Decision-Making in Disaster Management Asynchronous Methods for Deep Reinforcement Learning

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-05T12:28:46.408590Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T12:28:46.408590Z digest=sha256:caa46de7787103f2e54feb1d47185189d48fead61eb6345afcdbbc2a062e0377

Observation 248a5cbe-6cef-4ebd-8c7d-b93670f362d6 · inbound

A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games cites this paper.

A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games Asynchronous Methods for Deep Reinforcement Learning

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-05T10:51:56.247540Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T10:51:56.247540Z digest=sha256:4abbb61b32524e230c3aacbef6faf4c0c4d26458b0777be8fafc61f517103d52

Observation 477aea90-17af-4ccf-9725-f89da10cf80b · inbound

Necessary and Sufficient Conditions for the Optimization-Based Concurrent Execution of Learned Robotic Tasks cites this paper.

Necessary and Sufficient Conditions for the Optimization-Based Concurrent Execution of Learned Robotic Tasks Asynchronous Methods for Deep Reinforcement Learning

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-03T23:55:53.108582Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T23:55:53.108582Z digest=sha256:2a4a543609e55d3e299ce86a1792d3060ef12565c010ce2eba1577249838866a

Observation c233880e-de16-48bb-86ea-b6f88f9ed7d2 · inbound

Transformers with RL or SFT Provably Learn Sparse Boolean Functions, But Differently cites this paper.

Transformers with RL or SFT Provably Learn Sparse Boolean Functions, But Differently Asynchronous Methods for Deep Reinforcement Learning

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-03T20:57:11.920810Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-03T20:57:11.920810Z digest=sha256:0825000470f307153ad3f5edc82e6bbffb7990e08ede13d40acf0e517a196f20

Observation 7b9bc494-0ff0-42e0-afeb-d385aec7fcdb · inbound

A Review of Learning-Based Motion Planning: Toward a Data-Driven Optimal Control Approach cites this paper.

A Review of Learning-Based Motion Planning: Toward a Data-Driven Optimal Control Approach Asynchronous Methods for Deep Reinforcement Learning

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-03T16:52:54.802605Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T16:52:54.802605Z digest=sha256:b95719a53182988887fdec5b8fad48d10364d441620316b77b49a4768457ccc2

Observation 1d18b4dc-1663-4523-9a17-686e1ec90e27 · inbound

Beyond Distribution Sharpening: The Importance of Task Rewards cites this paper.

Beyond Distribution Sharpening: The Importance of Task Rewards Asynchronous Methods for Deep Reinforcement Learning

Reference 25

Resolution
metadata mismatch
arxiv_id, observed 2026-05-10T09:08:27.004699Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-05-10T08:07:14.691463Z digest=sha256:d105f957c867ce977256fc3a2a4eb8da7cdb99c95fe377016e41a4c61ec7edd7

Observation 2a08e8ea-ed33-4a82-8e8f-1b415fe476c4 · inbound

Planning in entropy-regularized Markov decision processes and games cites this paper.

Planning in entropy-regularized Markov decision processes and games Asynchronous Methods for Deep Reinforcement Learning

Reference 19

Resolution
verified exact
arxiv_id, observed 2026-05-10T03:24:14.906277Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-05-10T03:24:06.581955Z digest=sha256:f59f2804ea747ef0c659e82a83298278962210d67e5101f98517c64b155da353

Observation 92381a63-ae7d-4b7d-a382-37ad3b8bd449 · inbound

Distill-Belief: Closed-Loop Inverse Source Localization and Characterization in Physical Fields cites this paper.

Distill-Belief: Closed-Loop Inverse Source Localization and Characterization in Physical Fields Asynchronous Methods for Deep Reinforcement Learning

Reference 50

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T23:46:54.222203Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-07T16:17:39.220903Z digest=sha256:e9bb8dabdcecaa9bc80c94b7930b4b1c259886e3ab0844067adf301072663ee8

Observation a54eb4b1-22ae-4cde-8062-70be902893c1 · inbound

A Meta Reinforcement Learning Approach to Goals-Based Wealth Management cites this paper.

A Meta Reinforcement Learning Approach to Goals-Based Wealth Management Asynchronous Methods for Deep Reinforcement Learning

Reference 40

Resolution
metadata mismatch
arxiv_id, observed 2026-05-08T18:44:01.809731Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-05-08T18:42:50.962120Z digest=sha256:ec1166144762cd9c3abe2402ecb7739d0184e430ea474a9652494978169f94d5

Observation a02da45b-8498-4176-9851-b0c9054b0934 · inbound

Closed-Loop CO2 Storage Control With History-Based Reinforcement Learning and Latent Model-Based Adaptation cites this paper.

Closed-Loop CO2 Storage Control With History-Based Reinforcement Learning and Latent Model-Based Adaptation Asynchronous Methods for Deep Reinforcement Learning

Reference 70

Resolution
verified exact
arxiv_id, observed 2026-05-11T16:31:11.939348Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-09T16:16:34.154778Z digest=sha256:d7e2de44524231f22ae34fc9ce5cc9a6c7710ca138c3f0dbf395742787d192cb

Observation 26787b4f-df45-42eb-86e3-e764f31b25f3 · inbound

Closed-Loop CO2 Storage Control With History-Based Reinforcement Learning and Latent Model-Based Adaptation cites this paper.

Closed-Loop CO2 Storage Control With History-Based Reinforcement Learning and Latent Model-Based Adaptation Asynchronous Methods for Deep Reinforcement Learning

Reference 70

Resolution
verified exact
local_arxiv, observed 2026-07-01T00:55:12.291799Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-06-30T23:56:11.447285Z digest=sha256:5917fc9c66a0428d965bec13b5deccfce5975ce47404dc0797235fe12c9b78cb

Observation 7010be37-4c71-44eb-afab-a8de6b34730f · inbound

Long-Horizon Q-Learning: Accurate Value Learning via n-Step Inequalities cites this paper.

Long-Horizon Q-Learning: Accurate Value Learning via n-Step Inequalities Asynchronous Methods for Deep Reinforcement Learning

Reference 28

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T19:41:08.054024Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-05-08T11:20:19.749415Z digest=sha256:fc5d1b6dbaa191e042c66945022efbcd7dc356bedcafaf431ccd6fc6c5584ece

Observation 6f20f7a9-28cc-4409-b5da-1de45774a54c · inbound

Long-Horizon Q-Learning: Accurate Value Learning via n-Step Inequalities cites this paper.

Long-Horizon Q-Learning: Accurate Value Learning via n-Step Inequalities Asynchronous Methods for Deep Reinforcement Learning

Reference 28

Resolution
metadata mismatch
arxiv_id, observed 2026-05-12T05:41:24.287058Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-05-12T05:05:29.984355Z digest=sha256:f39a98b1352f6257be606f2020a28ea73dd75ffbdbb6891ac296caf8f37c9a7b

Observation 531d7397-13d5-4256-be0f-a28c667d5c58 · inbound

KL for a KL: On-Policy Distillation with Control Variate Baseline cites this paper.

KL for a KL: On-Policy Distillation with Control Variate Baseline Asynchronous Methods for Deep Reinforcement Learning

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-05-11T03:40:54.193594Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-11T03:31:07.462474Z digest=sha256:0045179b0b6f4373a7291de3d2ed3c525766b9dc8a1d35ab5cb6d4f0824b31b7

Observation d0c3a9bc-3274-4ddc-95a9-d9ef9cc52725 · inbound

Error whitening: Why Gauss-Newton outperforms Newton cites this paper.

Error whitening: Why Gauss-Newton outperforms Newton Asynchronous Methods for Deep Reinforcement Learning

Reference 40

Resolution
metadata mismatch
arxiv_id, observed 2026-05-13T02:17:07.107634Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-13T02:08:58.644797Z digest=sha256:2fd24ea1d9bc61e0f36d0ea8794ed61f137debdaafda190ef26da3de520e077e

Observation 0a9bdf5c-6c50-4c11-a99e-67a66e95b3aa · inbound

Delay-Empowered Causal Hierarchical Reinforcement Learning cites this paper.

Delay-Empowered Causal Hierarchical Reinforcement Learning Asynchronous Methods for Deep Reinforcement Learning

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-05-13T05:47:21.230331Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-13T05:46:51.659283Z digest=sha256:26996aed6f89ecd89699ed3a7a7ac021828a3d3f36e2c5bf337bdbeeb25510ba

Observation 0c1a59c5-7ac1-4bf8-b2e7-5296a3257f16 · inbound

Efficient On-policy Visual-RL via Stochastic Decoupled Policy Gradient cites this paper.

Efficient On-policy Visual-RL via Stochastic Decoupled Policy Gradient Asynchronous Methods for Deep Reinforcement Learning

Reference 34

Resolution
verified exact
local_arxiv, observed 2026-06-29T18:03:48.584775Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-06-29T17:34:41.053725Z digest=sha256:7a543853f671febeb1812ee49ca5e8f202edf70dc84a0039f5fcce9245808f6c

Observation 7add35e6-5071-4fa0-bc51-34352c392697 · inbound

SALT: When More Rollouts Don't Help in Group-Based Policy Optimization and How to Make Them Matter cites this paper.

SALT: When More Rollouts Don't Help in Group-Based Policy Optimization and How to Make Them Matter Asynchronous Methods for Deep Reinforcement Learning

Reference 26

Resolution
metadata mismatch
local_arxiv, observed 2026-07-02T11:46:56.175665Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-06-28T02:53:22.159132Z digest=sha256:235038918e584b1c6fcbb084bd892c9c1262f914b51cecae491749ac0ab3ee53

Observation bf0c0586-61db-445b-80db-e3ebf182fe08 · inbound

Themis: An explainable AI-enabled framework for Reinforcement Learning with Human Feedback cites this paper.

Themis: An explainable AI-enabled framework for Reinforcement Learning with Human Feedback Asynchronous Methods for Deep Reinforcement Learning

Reference 49

Resolution
verified exact
local_arxiv, observed 2026-07-04T17:40:00.108311Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-06-25T23:35:03.577967Z digest=sha256:b57ed9bfa00ce2eda29152e2554aff9026263b6aa64ad71d3923786efdfe2641

Observation 4b33b2be-4e57-43ab-814c-925877d73911 · inbound

The Hitchhiker's Guide to Agentic AI: From Foundations to Systems cites this paper.

The Hitchhiker's Guide to Agentic AI: From Foundations to Systems Asynchronous Methods for Deep Reinforcement Learning

Reference 178

Resolution
verified exact
local_arxiv, observed 2026-07-04T11:09:46.211891Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-06-26T08:09:57.542558Z digest=sha256:569cfc1725838f76a0874ca414fb96ab711d664c78b97b469e82eab12b1cc23b

Observation 362cd1cd-ea81-436f-8487-8f7eea64158b · inbound

The Hitchhiker's Guide to Agentic AI: From Foundations to Systems cites this paper.

The Hitchhiker's Guide to Agentic AI: From Foundations to Systems Asynchronous Methods for Deep Reinforcement Learning

Reference 178

Resolution
unresolved
no resolver link, observed 2026-08-02T10:27:18.375058Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T10:27:18.375058Z digest=sha256:abfc646a2f361d3578ea85f3629719e4781e6f87ced466596fa34f6d419f50ca

Observation da89960b-03b7-4bbe-abd0-0b3e57f312e8 · inbound

SAGE-Nav: Leveraging LLM Planning and Alignment Fusion for Hierarchical Scene Graph-Guided Navigation cites this paper.

SAGE-Nav: Leveraging LLM Planning and Alignment Fusion for Hierarchical Scene Graph-Guided Navigation Asynchronous Methods for Deep Reinforcement Learning

Reference 6

Resolution
verified exact
local_arxiv, observed 2026-07-04T19:20:06.921987Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-06-25T21:28:01.593510Z digest=sha256:9c352d37bbf4684de57df30cffdd6f22cc7879f3aa8340bd8d055cd0f003d1b5

Observation 0bcb39e3-a578-4c60-ac1c-0db23f348818 · inbound

Pre-Strings Lectures on Artificial Intelligence cites this paper.

Pre-Strings Lectures on Artificial Intelligence Asynchronous Methods for Deep Reinforcement Learning

Reference 170

Resolution
unresolved
no resolver link, observed 2026-07-12T06:14:03.658427Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T06:14:03.658427Z digest=sha256:9934a199708b759696b4d6cdc20ec09cae0c31b0ccd904f047dba977d2262b79

Observation bf0357d7-7771-4921-9df9-aac9114b7258 · inbound

Computational Determination of Optimal Growth Protocols for Metastable Polymorphs cites this paper.

Computational Determination of Optimal Growth Protocols for Metastable Polymorphs Asynchronous Methods for Deep Reinforcement Learning

Reference 162

Resolution
unresolved
no resolver link, observed 2026-07-12T02:58:08.912254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-12T02:58:08.912254Z digest=sha256:5f54cf8f8a8130792d683cf2321f3ae2268c8069144599ea70457162eef39360

Observation 8ad9131a-7af0-45cf-8b20-f10d2e21a72e · inbound

MPFlow: Learning Budgeted Max-Flow Optimization on the Lightning Network with Deep Graph Reinforcement Learning cites this paper.

MPFlow: Learning Budgeted Max-Flow Optimization on the Lightning Network with Deep Graph Reinforcement Learning Asynchronous Methods for Deep Reinforcement Learning

Reference 5

Resolution
verified exact
local_arxiv, observed 2026-07-10T02:56:43.532753Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-07-10T02:49:33.567169Z digest=sha256:0cdcd77c76259f43fceeba815aeb17851c7fae806b573be74fdc16314712fce0

Observation 51580c9e-d0c4-4db0-988b-5971a3102fc3 · inbound

Automated Stealthy Wear-Out Attack on Digital Twins With Deep Reinforcement Learning cites this paper.

Automated Stealthy Wear-Out Attack on Digital Twins With Deep Reinforcement Learning Asynchronous Methods for Deep Reinforcement Learning

Reference 35

Resolution
unresolved
no resolver link, observed 2026-07-14T08:57:07.143027Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T08:57:07.143027Z digest=sha256:88958af710ab95b74b7d415759cba80e45bf8f0dd7278c72d1a3fb408f5c6b8a

Observation 1b3c4aae-a291-4a4e-9c34-4ab197910224 · inbound

Hierarchical Residual Policy Optimization for Generative Recommendations cites this paper.

Hierarchical Residual Policy Optimization for Generative Recommendations Asynchronous Methods for Deep Reinforcement Learning

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-05T00:28:22.105962Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T00:28:22.105962Z digest=sha256:303c3273dc7d4da042a4c310badd3eea5914a48a85e6867023dc40e4a1a807f5