{"as_of":"2026-08-17T05:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bbb5712bd6f8f55261553ccc6ff50bcebeb47da23bc4b2df792ac82a54ab18db","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T14:35:06.467808Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.02974/citation-record","integrity":"/paper/1908.02974/integrity","json":"/paper/1908.02974/citation-record.json","paper":"/paper/1908.02974"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.314800Z","title":"Deep learning in neural networks: An overview,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.314800Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:7ed35de17fdd120a23714fda30ab7a0e7468c6499268dc9f76c31ee0353c8a49","observation_id":"09c5d78e-f803-48ea-8663-7b9bb9ef6764","resolution":{"observed_at":"2026-08-14T14:35:06.314800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.320284Z","title":"Learning from delayed rewards,","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.320284Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:48d72a5a19038e57d5917b042d11f443acc1246a20751de45ac1dc9e35f016b0","observation_id":"cc91f58d-07c0-4de5-922c-bf617ffa6600","resolution":{"observed_at":"2026-08-14T14:35:06.320284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:07.019595Z","title":"Improving elevator performance using reinforcement learning,","venue":null,"work_id":"232416d5-ad25-4c74-a53d-7bcf4952d1a5","year":1996},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.325025Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:5f40b409bb4b068097e4a1c6ed6472c5cb1683bab5c898904b83c3bc6eb1aea8","observation_id":"851ba975-5cf5-4a77-95b1-5757ba5ed4e2","resolution":{"observed_at":"2026-08-14T14:35:07.024763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:07.003678Z","title":"Effective reinforcement learning for mobile robots,","venue":null,"work_id":"7d342016-3d8f-41d2-9ec9-bf7720b169f0","year":2002},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.330171Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:1ea2621a29570936dd7db053a83a99e96993486559faf31cb2c7c0645dc88530","observation_id":"2be3ae16-b687-43a3-9431-3053f9069d61","resolution":{"observed_at":"2026-08-14T14:35:07.009099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.987870Z","title":"Ensemble algorithms in reinforce- ment learning,","venue":null,"work_id":"654d2494-efc1-470b-9a1b-e9a664eeb78a","year":2008},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.335616Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:8a4c7dc0738addc79457566eebe063edf73a89e5a225062edc4be111bdbf3807","observation_id":"a8e4c10c-ff67-4973-b87a-1b1ba158d44b","resolution":{"observed_at":"2026-08-14T14:35:06.993537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-14T14:35:06.340401Z","title":"Playing atari with deep reinforcement learn- ing,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.340401Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:7a376dd7dd8c7f33436dae80e1b9bb30b5c012c9b9cf7c26ead131c6793d75b9","observation_id":"b4c7e66c-3751-4aa5-9007-da717b78af29","resolution":{"observed_at":"2026-08-14T14:35:06.340401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.345379Z","title":"Human-level control through deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.345379Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:79e1b2834980e9b3f4ba8d56a1f2cdf3a8dbefccf242fcf3f1e027def8adb538","observation_id":"2fc2ebe3-f946-4eee-ae8e-7a2e9edbb861","resolution":{"observed_at":"2026-08-14T14:35:06.345379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.964450Z","title":"Deep reinforcement learning with double q-learning,","venue":null,"work_id":"d9cbd8c4-c00f-43ab-9d77-5e23ba82ff5c","year":2016},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.349609Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:1f4283d87631aa25e9be1f4bb1839ab131ad7a3425ec5f25a8ecca8227da14ee","observation_id":"e4b17a2f-3679-4b36-b352-12c2fd7858e7","resolution":{"observed_at":"2026-08-14T14:35:06.969639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-16T22:06:26.835611Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-14T14:35:06.360917Z","title":"Continuous control with deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.360917Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:466eb94d5052e76bbdff49c0549b03e50200462df423af3b6343d329bfe07153","observation_id":"257ccf5f-d67a-43be-a84b-bac58e9aa742","resolution":{"observed_at":"2026-08-14T14:35:06.360917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.364812Z","title":"Asynchronous methods for deep rein- forcement learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.364812Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:6da0cfea5b4f05ba566d518ffeb16c6d6b2e91ed050f824de9a5c803b1d42781","observation_id":"6da4ad92-648a-4cf4-8d61-557ac4f2bb25","resolution":{"observed_at":"2026-08-14T14:35:06.364812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-14T14:35:06.368950Z","title":"Prox- imal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.368950Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:64bacb7ebe887f82f2199750a77198007f02b9ab7462902ed4bb473c7d114ef3","observation_id":"3a3849ea-56ec-4ffe-bda1-f5224f017a65","resolution":{"observed_at":"2026-08-14T14:35:06.368950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.928342Z","title":"A novel off policy q (λ) algorithm based on linear function approximation,","venue":null,"work_id":"9825524d-3638-4874-a549-901b444b4b9b","year":2014},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.373499Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:f031edf8933bd519667a35e2b6f146b90ca98dccbbb68070852f5a774dad40ff","observation_id":"1bb6c34c-004c-42a3-8740-e590d392d828","resolution":{"observed_at":"2026-08-14T14:35:06.933545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.378489Z","title":"Reinforcement learning in robotics: A survey,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.378489Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:0add455025b05102cd4bf348336bb0ae696594cdb268f3fa3ab01bde7f577e06","observation_id":"7e3ccfbf-7c80-4fb5-9f6a-91bcedc569fb","resolution":{"observed_at":"2026-08-14T14:35:06.378489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.902114Z","title":"A reinforcement learning-based approach to dynamic job-shop scheduling,","venue":null,"work_id":"91afff11-fa93-4a1e-87fb-99538e4bcdfd","year":2005},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.384336Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:c3b55fc4cfa81430f90b5c7e294ab42fd87aee72f996247a3f2eae141e05a010","observation_id":"fed0b723-e6ce-43f8-9f2a-be65d1340619","resolution":{"observed_at":"2026-08-14T14:35:06.909397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.883592Z","title":"Self-optimizing memory controllers: A reinforcement learning approach,","venue":null,"work_id":"4b0bba39-cb1e-4e57-9167-88300157db63","year":2008},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.390080Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:3a92a446f75d0861e3d99cbc8081350f5e092652718d0aab37d5df505814f794","observation_id":"5b1888d8-4e71-45c2-9655-70f2c5b0232c","resolution":{"observed_at":"2026-08-14T14:35:06.891950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.864682Z","title":"Td-gammon, a self-teaching backgammon program, achieves master-level play,","venue":null,"work_id":"8123513c-9604-40c3-9071-2ede3a8c7b6f","year":1994},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.394666Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:669137c16863aa4ec234af958bd167ca6883c06735dbb4d21ff7b6c31f72ceef","observation_id":"4360de04-1dcd-4a0a-85ae-82d7b335812a","resolution":{"observed_at":"2026-08-14T14:35:06.870878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.398849Z","title":"Bandit based monte-carlo planning,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.398849Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:629e6380b0f1a7544600908366db271d2b996aab62b1599d315e30e809a0e7b8","observation_id":"4617aa21-3072-4a79-9de8-5173a4bc3a27","resolution":{"observed_at":"2026-08-14T14:35:06.398849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.841965Z","title":"Mastering the game of go with deep neural networks and tree search,","venue":null,"work_id":"454518a0-a931-48ac-ba76-a9cf3147798b","year":2016},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.403899Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:db0303a91e4af00adc3dd4660899917a2195422031fd0e5d630f6414b5ceefcd","observation_id":"9401d985-0b6b-46bc-af2b-3f40faf78d0d","resolution":{"observed_at":"2026-08-14T14:35:06.846765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.408620Z","title":"Bench- marking deep reinforcement learning for continuous control,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.408620Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:15ff518550ff85c57578d607ba3a06e8f7d374a768c73ec2f283a7638f5f0e9f","observation_id":"0c8fc3aa-531a-4b56-8da1-09ec7f9f24e6","resolution":{"observed_at":"2026-08-14T14:35:06.408620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.951203Z","title":"Continuous deep q- learning with model-based acceleration,","venue":null,"work_id":"91de2605-794c-4652-97cf-43a5e3517c88","year":2016},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.413680Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:a0c3c1572c887f43cdb4c8c5898bd82dfb5d514491980ff1fa143ec2d2655204","observation_id":"0b1f8f73-8794-4a6a-9855-3e2384c615f4","resolution":{"observed_at":"2026-08-14T14:35:06.956238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.04062","last_updated":"2016-06-19T20:21:08Z","snapshot_observed_at":"2026-08-14T22:10:35.408022Z","submitted_at":"2016-02-12T14:16:59Z","title":"Using Deep Q-Learning to Control Optimization Hyperparameters","version":2},"cited_work":{"arxiv_id":"1602.04062","doi":null,"metadata_source":"pith","pith_arxiv_id":"1602.04062","snapshot_observed_at":"2026-08-14T14:35:06.550335Z","title":"Using Deep Q-Learning to Control Optimization Hyperparameters","venue":"math.OC","work_id":"d7c71038-c538-46f7-867e-080641cb9b30","year":2016},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.418591Z"},"links":{"cited_paper":"/paper/1602.04062","citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:3aa163b0ec112f801a17b5bd575a3496a2e9397798bbe5ca1d27a6626706376b","observation_id":"2558e0f1-2d99-4b59-a1e3-f045f59809e7","resolution":{"observed_at":"2026-08-14T14:35:06.556361Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.423048Z","title":"Learning to learn by gradient descent by gradient descent,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.423048Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:bce85d9079f9dbc2e1f025f3df0a12fe9a8eb300b29c3799d196567d7f969011","observation_id":"99c4b14f-e4ca-4235-9109-aeb5b446ceff","resolution":{"observed_at":"2026-08-14T14:35:06.423048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.813199Z","title":"Action-conditional video prediction using deep networks in atari games,","venue":null,"work_id":"69318210-7017-46ad-b41b-b99fada2d6ca","year":2015},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.427430Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:ac9af6c73b0e3e06ba90fdf646b5f0241e945a3c0d683a28236957b1b1b50ced","observation_id":"3665650d-4c9b-4c27-b92f-7c4ecc86d5db","resolution":{"observed_at":"2026-08-14T14:35:06.819445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.799621Z","title":"Active object localization with deep reinforcement learning,","venue":null,"work_id":"8a564322-6a17-4a82-b177-46e372f0e43f","year":2015},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.432167Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:d862387f0a57a826e9148c377ea185cc614e44f9e5696f1f305ad3901a6ba563","observation_id":"ed8dc05f-93dc-49a8-ac03-5073c6bb34be","resolution":{"observed_at":"2026-08-14T14:35:06.804452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.03791","last_updated":"2015-11-13T05:41:08Z","snapshot_observed_at":"2026-08-14T22:23:45.420489Z","submitted_at":"2015-11-12T06:19:59Z","title":"Towards Vision-Based Deep Reinforcement Learning for Robotic Motion Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.03791","snapshot_observed_at":"2026-08-14T14:35:06.436953Z","title":"Towards vision-based deep reinforcement learning for robotic motion control,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.436953Z"},"links":{"cited_paper":"/paper/1511.03791","citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:d5a687aa38eec3cfeb4ad1e96dd2cfb7623d593e94b3066e19615f4be0d773ba","observation_id":"5ac60bf2-2d4a-4ae0-877d-965ec105aa91","resolution":{"observed_at":"2026-08-14T14:35:06.436953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.442675Z","title":"Oksendal, Stochastic differential equations: an introduction with applications","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.442675Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:a8f8dbe27fc499fcd6f18710c402954c913364c6ed0f44912afeea81af9491af","observation_id":"50eae923-686f-4583-9cf0-8d9b8bc7a9bb","resolution":{"observed_at":"2026-08-14T14:35:06.442675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.776320Z","title":"A deep reinforcement learning approach to preserve connectivity for multi-robot systems,","venue":null,"work_id":"08dc3eae-8ab4-429d-b3cc-690ad331e024","year":2017},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.451833Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:aa9fae671b07605eeb1359b1fb7e5c4b7d64c61bb46c9e79494434f078d598c9","observation_id":"a8282875-9d88-4169-b6ab-7f39ccce3f63","resolution":{"observed_at":"2026-08-14T14:35:06.782201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.625712Z","title":"Maximum likelihood estimation for the drift parameter in diffusion processes,","venue":null,"work_id":"5213dcfe-89ff-4a9c-8275-d60252bbaca7","year":2016},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.458520Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:3b712290faecca18ad37a4c883905cf7ce02d7eebc29395b96e5a9307f388915","observation_id":"8f5e919f-65bb-4be7-a2f0-b891819eeeaa","resolution":{"observed_at":"2026-08-14T14:35:06.760802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:35:06.609799Z","title":"Gilbarg and N","venue":null,"work_id":"3ff7c6b3-23b8-442c-9c35-62b708155305","year":1998},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.463345Z"},"links":{"citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:d9b3d5c9ea9ec0b5212c4285ac9f211162d44a60ab8207a06885e5fa491b51f2","observation_id":"f1164fc8-31b2-4f64-8058-fea620ebcd5c","resolution":{"observed_at":"2026-08-14T14:35:06.615530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1702.06230","last_updated":"2017-05-08T15:03:25Z","snapshot_observed_at":"2026-08-14T21:15:35.980019Z","submitted_at":"2017-02-21T01:06:11Z","title":"Beating the World's Best at Super Smash Bros. with Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"1702.06230","doi":null,"metadata_source":"pith","pith_arxiv_id":"1702.06230","snapshot_observed_at":"2026-08-14T14:35:06.508858Z","title":"Beating the World's Best at Super Smash Bros. with Deep Reinforcement Learning","venue":"cs.LG","work_id":"573a50e5-83e7-41aa-9a3a-d6e523744c24","year":2017},"citing_paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T14:35:06.467808Z"},"links":{"cited_paper":"/paper/1702.06230","citing_paper":"/paper/1908.02974"},"observation_digest":"sha256:e410f0013a76f94632f2be9af629e1386a28b0479a919b8a61e4c14f161d40e0","observation_id":"ec7c853e-8a99-4ea5-9ec8-c245d7c0b55e","resolution":{"observed_at":"2026-08-14T14:35:06.517208Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.02974","last_updated":"2019-08-08T08:38:11Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T05:22:57.428079Z","submitted_at":"2019-08-08T08:38:11Z","title":"Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":2,"verified_fuzzy":15},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:1908.02974."}