{"as_of":"2026-08-08T05:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0577b228f6f7ad6d089ce728645ff071bb437513c26bf14848e1670696d2fa08","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:05:16.273950Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.11975/citation-record","integrity":"/paper/2507.11975/integrity","json":"/paper/2507.11975/citation-record.json","paper":"/paper/2507.11975"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.124172Z","title":"Imagenet classification with deep convolutional neural networks,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.124172Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:8c45553ef0bf77d2f64ed961d5ae0c203cce9a613903c20abefb076056f8b825","observation_id":"5adbb0aa-ba8e-489f-bff9-5c7d3e1b8547","resolution":{"observed_at":"2026-08-06T17:05:16.124172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05587","last_updated":"2017-12-05T18:06:21Z","snapshot_observed_at":"2026-08-07T13:44:53.690521Z","submitted_at":"2017-06-17T22:48:57Z","title":"Rethinking Atrous Convolution for Semantic Image Segmentation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05587","snapshot_observed_at":"2026-08-06T17:05:16.127902Z","title":"Rethinking atrous convolution for semantic image segmentation,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.127902Z"},"links":{"cited_paper":"/paper/1706.05587","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:df2ad4c9b5cfe1520fa51a93f8b5379afd0d9910d2152efd34b1bfa44b99f218","observation_id":"8b2f03e3-8ac8-4b2d-abc3-d81959d4056f","resolution":{"observed_at":"2026-08-06T17:05:16.127902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.622313Z","title":"Speech recognition with deep recurrent neural networks,","venue":null,"work_id":"28d69e4b-927c-40b7-893a-f9b3eab3b0b9","year":2013},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.131915Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:b77d7c495da8585d592dc01e127bff6e9e57c58603a89b83be9b551aed365be4","observation_id":"e184e0a3-f345-43d8-bd51-0961048e9ce2","resolution":{"observed_at":"2026-08-06T17:05:16.625187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.136750Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.136750Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:c52bb78acac143c680973354acce64e999619bdfee2c47fb8f2f388eb7ecff25","observation_id":"7eaf585e-f1af-4656-9a3b-3c4bcb18aaf6","resolution":{"observed_at":"2026-08-06T17:05:16.136750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.140459Z","title":"Self-supervised learning: Generative or contrastive,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.140459Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:3212c579eb983fafd64ed85c97695f1a87a8f48447c86cfd42d01d13a9681374","observation_id":"fc7e3626-3bdf-4802-949e-90c33a83b5b5","resolution":{"observed_at":"2026-08-06T17:05:16.140459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.143221Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.143221Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:bd9d9f6106f45949a7b6800048389ae711bbbc6b5e18b94a3abab0df8936f22d","observation_id":"4a249cf3-76e0-4980-bce3-e15c2eeee26f","resolution":{"observed_at":"2026-08-06T17:05:16.143221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T17:05:16.145892Z","title":"Playing atari with deep reinforcement learning,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.145892Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:91b523d4a79287472f60c2e93b7c1887e74f2f25eb44a1756bc618f6343fd142","observation_id":"e03599f9-a4a9-4fbd-b82d-6fb9dafc81f6","resolution":{"observed_at":"2026-08-06T17:05:16.145892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.604686Z","title":"Human-level control through deep reinforce- ment learning,","venue":null,"work_id":"0143ed6a-658d-430f-b1d0-98276aa0042d","year":2015},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.148917Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:6ed60a25dcc99638784cde543d1e38eec40ed433d194da628f4a98b64a13bad5","observation_id":"7a969424-75c8-430b-bc87-d71d0e714705","resolution":{"observed_at":"2026-08-06T17:05:16.607540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.597295Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":"c83bdcdc-3d34-406d-ad03-7e94be8ecf71","year":2018},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.151204Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:911be6858140aca2865715d3a509b6b0c7ffd310c40c51b8fc396ea42dd84327","observation_id":"612ee690-754d-435e-a18e-f42fcfba9962","resolution":{"observed_at":"2026-08-06T17:05:16.600250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.590818Z","title":"Addressing function approximation error in actor-critic meth- ods,","venue":null,"work_id":"39ff44b9-db1c-41b0-815d-549b8473991b","year":2018},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.154533Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:1ba1926645630cebab77c5a7985b6fac78c34aeee7a7daf988dd43720d683836","observation_id":"169a99c4-7aee-41fb-9ea1-f1ea79bfbafa","resolution":{"observed_at":"2026-08-06T17:05:16.593517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T17:05:16.157029Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.157029Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:d1a115957412680fef2dd89aa1a2a61f8097ac9d20056b3c41a5dd3470ab6d08","observation_id":"a24931a3-2a2e-47a1-9fbd-13bf153d8d33","resolution":{"observed_at":"2026-08-06T17:05:16.157029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.02648","last_updated":"2018-12-06T16:36:20Z","snapshot_observed_at":"2026-07-06T07:19:38.028327Z","submitted_at":"2018-12-06T16:36:20Z","title":"Deep Reinforcement Learning and the Deadly Triad","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.02648","snapshot_observed_at":"2026-08-06T17:05:16.160121Z","title":"Deep reinforcement learning and the deadly triad,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.160121Z"},"links":{"cited_paper":"/paper/1812.02648","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:4fa44ce96d04617b0b1d4c5303193b19bcd8fd0d3c04d27bdf63b33ee37d7c9b","observation_id":"e8699051-7f93-4e96-a5e3-5f164f97471c","resolution":{"observed_at":"2026-08-06T17:05:16.160121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.09163","last_updated":"2020-11-27T20:22:38Z","snapshot_observed_at":"2026-07-06T10:05:35.400002Z","submitted_at":"2020-10-19T01:27:07Z","title":"D2RL: Deep Dense Architectures in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.09163","snapshot_observed_at":"2026-08-06T17:05:16.163294Z","title":"D2rl: Deep dense architectures in reinforcement learning,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.163294Z"},"links":{"cited_paper":"/paper/2010.09163","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:97a15462ed06a8503af55065c944f491ebf34b737b965545bf1dd9427c942d03","observation_id":"7bfbc8f4-465a-4d32-8509-a295fe290c3d","resolution":{"observed_at":"2026-08-06T17:05:16.163294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.05990","last_updated":"2020-06-10T17:59:03Z","snapshot_observed_at":"2026-07-06T09:27:47.020846Z","submitted_at":"2020-06-10T17:59:03Z","title":"What Matters In On-Policy Reinforcement Learning? A Large-Scale Empirical Study","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.05990","snapshot_observed_at":"2026-08-06T17:05:16.167535Z","title":"What matters in on-policy reinforcement learning? a large-scale empirical study,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.167535Z"},"links":{"cited_paper":"/paper/2006.05990","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:0ccc8d9bb3628012de0cc7fba9be70ae08f5365ccccebd7d8cc43c95ff38cd11","observation_id":"b0bd07b4-47d3-45fb-8dd6-c316ec3a8241","resolution":{"observed_at":"2026-08-06T17:05:16.167535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.583744Z","title":"Deterministic policy gradient algorithms,","venue":null,"work_id":"e993edfd-7ed0-4c19-87f3-1d121f1440a5","year":2014},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.170107Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:3bb61da27dfca341429df25784dd33f6a5a13847785b3a4f53b081eaeb55a223","observation_id":"44dd1381-2aef-49d3-bb5f-3ef10a720172","resolution":{"observed_at":"2026-08-06T17:05:16.586314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.576808Z","title":"Can increasing input dimensionality improve deep reinforcement learning?,","venue":null,"work_id":"f9743fd6-773d-4204-9f2b-214c19c140c9","year":2020},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.173158Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:63c98b01342ce07358d3a2287ffd26e870077c069adc08c84925c348cd7a3f9c","observation_id":"a589ac17-4db4-4fb0-a82f-62b28de40bf0","resolution":{"observed_at":"2026-08-06T17:05:16.579523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.568688Z","title":"A framework for training larger networks for deep Reinforce- ment learning,","venue":null,"work_id":"693c725f-e6eb-45b6-a1ee-67b00bb95988","year":2024},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.175720Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:9a9c31178abd84c4c167cee0559e3c5cb18e41346a41bafd865b297f51d346b2","observation_id":"812ec8fd-83c2-421b-be56-8fb4a43951ac","resolution":{"observed_at":"2026-08-06T17:05:16.571286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.561437Z","title":"Bigger, better, faster: human-level atari with human-level efficiency,","venue":null,"work_id":"453d54e9-3faa-4e65-8b0d-df2837d39a95","year":2023},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.178217Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:169f8255923cbadae97b8e16c1e25941c4793cb33c7feb49392e1dfc0641af0d","observation_id":"656e0d66-ca70-4c26-85e2-e76f34780862","resolution":{"observed_at":"2026-08-06T17:05:16.563994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12567","last_updated":"2023-04-25T04:25:08Z","snapshot_observed_at":"2026-07-06T15:19:39.223171Z","submitted_at":"2023-04-25T04:25:08Z","title":"Proto-Value Networks: Scaling Representation Learning with Auxiliary Tasks","version":1},"cited_work":{"arxiv_id":"2304.12567","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.12567","snapshot_observed_at":"2026-08-06T17:05:16.354990Z","title":"Proto-Value Networks: Scaling Representation Learning with Auxiliary Tasks","venue":"cs.LG","work_id":"6f31d89b-3e0d-4baa-a842-f868ba0af0fa","year":2023},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.180812Z"},"links":{"cited_paper":"/paper/2304.12567","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:4f88441b41fb302a48cf530df138b96b651b3fdd7d35fbecb8090e9288798645","observation_id":"1aebfac9-46fb-4dfd-83b5-054efaf6b447","resolution":{"observed_at":"2026-08-06T17:05:16.358844Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-06T17:05:16.183468Z","title":"Mastering diverse domains through world models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.183468Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:81fd87d9e918520bee1cc2285874fe0976de9c2cf1a3d5bfd0b786dbda0c2fb2","observation_id":"b0723549-b88f-4ace-8b6c-b87d8c3c96ef","resolution":{"observed_at":"2026-08-06T17:05:16.183468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.553434Z","title":"Learning both weights and connections for efficient neural networks,","venue":null,"work_id":"28f0d8ba-254e-44d2-8ce7-15742dcbacb6","year":2015},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.185864Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:49f026c1ff5bcb3ba39c504cd2a14f159f8a009fffc49dc250cdc3af3c231b05","observation_id":"a57f3804-d4ca-44ef-85b4-83002c95ebb4","resolution":{"observed_at":"2026-08-06T17:05:16.557017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.545407Z","title":"What is the state of neural network pruning?,","venue":null,"work_id":"17d08e7d-17bc-46f7-b0d9-d6f5188fd5f6","year":2020},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.188472Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:f10bf942317faa0c6da91cb36df0014b49b7d22112c879083661f4970328a0ca","observation_id":"e9fbab70-f307-4599-8c82-e46478f8d94b","resolution":{"observed_at":"2026-08-06T17:05:16.548863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1608.08710","last_updated":"2017-03-10T17:57:56Z","snapshot_observed_at":"2026-07-06T05:08:42.861486Z","submitted_at":"2016-08-31T02:29:59Z","title":"Pruning Filters for Efficient ConvNets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.08710","snapshot_observed_at":"2026-08-06T17:05:16.190846Z","title":"Pruning filters for efficient convnets,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.190846Z"},"links":{"cited_paper":"/paper/1608.08710","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:82864741d3e618567c542795dff1a5f1f916106425b5f1e1083e55d3929a7b05","observation_id":"5e4675f8-d82e-4607-86b8-8ba62b132588","resolution":{"observed_at":"2026-08-06T17:05:16.190846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.536629Z","title":"Lost in pruning: The effects of pruning neural networks beyond test accuracy,","venue":null,"work_id":"6f58081e-71f7-44a3-8f3c-db40bd21f641","year":2021},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.193478Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:63d3c207a2cbe7d607903cc3484bd1be46f70c09c7d9f3d9464d41f7ca0875d8","observation_id":"846c6d15-1b28-4694-9cb8-e14a7470b052","resolution":{"observed_at":"2026-08-06T17:05:16.539662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.528946Z","title":"SCOP: scientific control for reliable neural network pruning,","venue":null,"work_id":"d4ef252f-0525-4faf-8fdd-9ae41af98b4a","year":2020},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.196613Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:d1f3c32511c255de136f14e32434789654b9af881a5f63b8d665bda2d8557142","observation_id":"743ab64d-1ee0-4e35-8d3a-75128e2fe48e","resolution":{"observed_at":"2026-08-06T17:05:16.531595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.519677Z","title":"Robust learning of parsimonious deep neural networks,","venue":null,"work_id":"52b4cc9e-1e02-444b-a144-bd40ed6b9aea","year":2024},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.199276Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:630a2225be4d9bbf0bace60b09a3ed477da726e5101d0868649a83e749d08c7e","observation_id":"5ad395b9-e524-46f5-970b-980bbcbd9cbb","resolution":{"observed_at":"2026-08-06T17:05:16.523851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.511415Z","title":"Shallowing deep networks: Layer-wise pruning based on feature representa- tions,","venue":null,"work_id":"a5207718-06a1-422c-a4a9-4d688d8d3e76","year":2019},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.201848Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:6f9bc99f2d6290e40bf82c68c638e19af2a1f991a589b33d1a2734bb9ae0dd0d","observation_id":"20484b75-ce33-41d1-b2ef-1decc143ae03","resolution":{"observed_at":"2026-08-06T17:05:16.514958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.10178","last_updated":"2019-12-21T02:11:47Z","snapshot_observed_at":"2026-07-06T08:46:12.464068Z","submitted_at":"2019-12-21T02:11:47Z","title":"DBP: Discrimination Based Block-Level Pruning for Deep Model Acceleration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.10178","snapshot_observed_at":"2026-08-06T17:05:16.204646Z","title":"Dbp: Discrimination based block-level pruning for deep model acceleration,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.204646Z"},"links":{"cited_paper":"/paper/1912.10178","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:e46bf765b7fbbca551d64dd65dfaa25a9f88bd92a156e6fc5ecc2da25745d18c","observation_id":"a2602985-b3b3-4641-aaa7-c1f2459c45aa","resolution":{"observed_at":"2026-08-06T17:05:16.204646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04549","last_updated":"2024-06-06T23:19:57Z","snapshot_observed_at":"2026-08-05T23:14:24.294176Z","submitted_at":"2024-06-06T23:19:57Z","title":"Concurrent Training and Layer Pruning of Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04549","snapshot_observed_at":"2026-08-06T17:05:16.207626Z","title":"Concurrent training and layer pruning of deep neural networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.207626Z"},"links":{"cited_paper":"/paper/2406.04549","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:23b7b9d133f12536cfed790271d9d05ffe85c2423fc1e2311a94f865f06a0883","observation_id":"fcbb66cd-9d04-47a9-9245-f88f6bc35c8c","resolution":{"observed_at":"2026-08-06T17:05:16.207626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.210505Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.210505Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:c638e7d9799e9690ec8384dcf2e0caf6468d3b54211014f3bdd70814753db1db","observation_id":"077b9460-62eb-4280-aa8b-21b325227f79","resolution":{"observed_at":"2026-08-06T17:05:16.210505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.497507Z","title":"The state of sparse training in deep reinforcement learning,","venue":null,"work_id":"329001ad-39ad-499e-9470-a92cc82491c3","year":2022},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.212910Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:75129936b718a399c250bbc72a1e8138578901946cd48793e00cd4da233e70a3","observation_id":"52569f7f-427f-423a-bf02-edd2435c72e7","resolution":{"observed_at":"2026-08-06T17:05:16.500702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.490210Z","title":"Automatic noise filtering with dynamic sparse training in deep reinforcement learning,","venue":null,"work_id":"a07f42b7-fb68-44b6-b823-32d7a1b74593","year":2023},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.216448Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:6982dc05b2d2d0ce1eb6b1aa613cc75d6daca27d6fbb9effd7f61ee5015fe604","observation_id":"990b365b-583c-44a0-ae0e-9d79efc4b6ce","resolution":{"observed_at":"2026-08-06T17:05:16.492813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.482182Z","title":"In value-based deep reinforcement learning, a pruned network is a good network,","venue":null,"work_id":"d3ae95db-c750-431b-948c-a47d7afce4ea","year":2024},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.220193Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:7148a021948a12385a0fee4b483f14f6a115dddd166f4897bf6493ffde928739","observation_id":"13e34952-13ba-4ec9-bdad-9f44f194942a","resolution":{"observed_at":"2026-08-06T17:05:16.484983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.473760Z","title":null,"venue":null,"work_id":"4b2f443d-8efe-4c0c-805a-9e554679b6c0","year":2025},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.223238Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:7f088ceea830384a3e5fb9b23aca6c227f49afe9b57508fb0190e6187bc47bfa","observation_id":"b0cb0439-19f1-4dde-acae-aaa0a1c7e752","resolution":{"observed_at":"2026-08-06T17:05:16.476928Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09127","last_updated":"2025-07-16T11:39:10Z","snapshot_observed_at":"2026-08-02T17:30:57.938749Z","submitted_at":"2024-11-14T02:00:22Z","title":"Complexity-Aware Training of Deep Neural Networks for Optimal Structure Discovery","version":2},"cited_work":{"arxiv_id":"2411.09127","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.09127","snapshot_observed_at":"2026-08-06T17:05:16.321541Z","title":"Complexity-Aware Training of Deep Neural Networks for Optimal Structure Discovery","venue":"cs.LG","work_id":"bff0acfc-65a6-4c09-add8-26382a571e1c","year":2024},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.226076Z"},"links":{"cited_paper":"/paper/2411.09127","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:db0f131c6756b7b77b40862bfa1809b089b5827195c605017b66d598cad0d078","observation_id":"2f612277-8f92-4ae1-9899-32960ad99a4f","resolution":{"observed_at":"2026-08-06T17:05:16.327100Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02975","last_updated":"2019-12-28T04:04:43Z","snapshot_observed_at":"2026-07-06T08:42:30.413190Z","submitted_at":"2019-12-06T04:52:16Z","title":"Observational Overfitting in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02975","snapshot_observed_at":"2026-08-06T17:05:16.229659Z","title":"Observational overfitting in reinforcement learning,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.229659Z"},"links":{"cited_paper":"/paper/1912.02975","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:7da255fc3544689fd6d165a667b1fad387e2cdb2d7805609ecc5ec9cf1bfba57","observation_id":"f0db245f-0116-47fc-b940-4fb12dc81a83","resolution":{"observed_at":"2026-08-06T17:05:16.229659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.06893","last_updated":"2018-04-20T16:49:52Z","snapshot_observed_at":"2026-08-04T06:10:10.723883Z","submitted_at":"2018-04-18T19:49:13Z","title":"A Study on Overfitting in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.06893","snapshot_observed_at":"2026-08-06T17:05:16.233411Z","title":"A study on overfitting in deep reinforcement learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.233411Z"},"links":{"cited_paper":"/paper/1804.06893","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:f390311d664501a46308b73685a78c60656d406ec48498bf8bacfe567620129c","observation_id":"e651a0b8-8fc1-4d14-ba87-a88158cbfd99","resolution":{"observed_at":"2026-08-06T17:05:16.233411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.466898Z","title":"Learning state representation for deep actor-critic control,","venue":null,"work_id":"64ea1efa-948f-465f-b9e3-d33436a359e2","year":2016},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.237333Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:1d037ff660a923b9bd1443120ec54aa67bd481020f7be2ef247ab291bbd84c5f","observation_id":"a0457d13-9d9c-408e-9be9-3b69210cbcc2","resolution":{"observed_at":"2026-08-06T17:05:16.469538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.239992Z","title":"Densely connected convolutional net- works,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.239992Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:0adaa76e6b89ff557eb0d88e5d01321b97eb5e01578d0d7d1c7c1bc6ccf7fbe3","observation_id":"bc746c52-0d47-4821-b9e9-c5e54baa1946","resolution":{"observed_at":"2026-08-06T17:05:16.239992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-07-06T18:51:06.750136Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17032","snapshot_observed_at":"2026-08-06T17:05:16.242243Z","title":"Gymnasium: A standard interface for reinforcement learning environ- ments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.242243Z"},"links":{"cited_paper":"/paper/2407.17032","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:43b00363421b47090119cabffdf1dee03ac8869476ba1790c2bf1d3ed2c1b253","observation_id":"b1d234d2-e4bd-4001-9483-4e6ec4242098","resolution":{"observed_at":"2026-08-06T17:05:16.242243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-06T17:05:16.245637Z","title":"Estimating or propagating gradients through stochastic neurons for conditional computation,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.245637Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:5255b2f97e40a7eb9c7fbf6d8e4f09ef48812f64e6c6929617ae920fde334587","observation_id":"e9a0a543-82b3-40ca-b780-9b93b0f1a161","resolution":{"observed_at":"2026-08-06T17:05:16.245637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.453279Z","title":"Dropout: a simple way to prevent neural networks from overfitting,","venue":null,"work_id":"eb080d67-5b8d-4ef1-875f-ed5ebd0d5815","year":1929},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.248770Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:276307e3e7ad9d8c9d51527ee6a0f123aab271ba5927028df9e5afeec9cfacda","observation_id":"631b7a3f-3b58-4175-bc79-fa2e76fbbba4","resolution":{"observed_at":"2026-08-06T17:05:16.456950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.445844Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift,","venue":null,"work_id":"f3c0286d-bbde-49f7-986e-0841eec302fb","year":2015},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.251263Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:c69e17e498d37e12e671952231c01d7f419cc305d08e58a9d6765648425ddb3b","observation_id":"d252ee97-7557-4d17-9d46-36dbc45db5c7","resolution":{"observed_at":"2026-08-06T17:05:16.448994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.437245Z","title":"How does batch normalization help optimization?,","venue":null,"work_id":"7f75c365-0492-46ec-9b25-002739a23ea2","year":2018},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.254389Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:ee2d09ade72b8172c728ec565391ebf3353fc56814287a14b9d1c14575cd87d1","observation_id":"31a16712-0d15-4fa5-9179-46ddf9c96242","resolution":{"observed_at":"2026-08-06T17:05:16.439794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.257106Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.257106Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:acb23ac5e627b5b43b7823360424c9cfc8ef3d65c7e08e385c9d0806f632accb","observation_id":"2b458270-4b06-4c91-8151-8e7dd30a2443","resolution":{"observed_at":"2026-08-06T17:05:16.257106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.260023Z","title":"Deep reinforcement learning that matters,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.260023Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:64fbcea3dcf78da5a84c4e844baf296c4a35439150c92727f3084d66d050476f","observation_id":"d2c10150-1c06-4875-8eba-8d718d61435e","resolution":{"observed_at":"2026-08-06T17:05:16.260023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.422343Z","title":"Dropout as a bayesian approximation: Representing model uncertainty in deep learning,","venue":null,"work_id":"d509dc7d-c975-4d4d-8c4d-e2a0c9449c56","year":2016},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.262307Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:2fcd2ba7802e6b7470366f507cf23fc39f02c69b7d3f8371f1d86c1959734021","observation_id":"c12f384d-4ab2-4c2c-a19b-4cf4650eab4f","resolution":{"observed_at":"2026-08-06T17:05:16.425769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.414312Z","title":"Dropout q-functions for doubly efficient reinforcement learning,","venue":null,"work_id":"1cd68b0c-4820-4afe-990b-0050daffb433","year":2022},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.265985Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:2becf976b457cf6f820e614765105823ef8842ba04e30ce8fa96c30cc938a0e5","observation_id":"5723c572-75dc-4b8d-9441-86fdeb180f28","resolution":{"observed_at":"2026-08-06T17:05:16.417015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.406570Z","title":"Regularization matters in policy optimization-an empirical study on continuous control,","venue":null,"work_id":"c01004f9-4123-418c-8bc1-e95b883ee1ca","year":2020},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.268470Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:856ba50e6e83578e00b9cb204a7a6968ef2e3c05549a864b3ebf84b2a7d064d8","observation_id":"4e3b9397-2f69-47f6-909b-7b8e43ca2c5e","resolution":{"observed_at":"2026-08-06T17:05:16.409991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:05:16.397572Z","title":"Implicit under-parameterization inhibits data-efficient deep reinforcement learning,","venue":null,"work_id":"705ef107-fe96-4289-9a97-40052bf9be7b","year":2021},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.270887Z"},"links":{"citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:c5f60e026aa982835cea34149980ff96fb239d83be8b4689590688910b7fd937","observation_id":"1a174c10-caf5-4b6a-96e8-963c2e1c2e73","resolution":{"observed_at":"2026-08-06T17:05:16.401286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T17:05:16.273950Z","title":"A method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:16.273950Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.11975"},"observation_digest":"sha256:c25140305a058c8ede4efda67776a42db82c3b02836679109e6c045385783c91","observation_id":"9ea20eae-0311-4e67-a99a-7a6f0008e3b8","resolution":{"observed_at":"2026-08-06T17:05:16.273950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.11975","last_updated":"2025-07-16T07:17:41Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T23:33:14.806957Z","submitted_at":"2025-07-16T07:17:41Z","title":"Online Training and Pruning of Deep Reinforcement Learning Networks"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":2,"verified_fuzzy":25},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2507.11975."}