{"as_of":"2026-08-22T23:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b262dfb4c3062ccb757506df5ee7d0cf2e0492b2f5017a8fc768bfa01be8cb19","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:55:37.787566Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T17:28:00.929990Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T03:59:33.003770Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"cited_work":{"arxiv_id":"2506.01016","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01016","snapshot_observed_at":"2026-07-04T03:59:33.003770Z","title":"Optimistic critics can empower small actors,","venue":null,"work_id":"c8cd9c38-bbdc-4a87-8c96-6c77a2555368","year":2025},"citing_paper":{"arxiv_id":"2606.20210","last_updated":"2026-06-18T13:23:19Z","snapshot_observed_at":"2026-08-06T06:19:35.750721Z","submitted_at":"2026-06-18T13:23:19Z","title":"Augmenting Game AI with Deep Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T17:28:00.929990Z"},"links":{"cited_paper":"/paper/2506.01016","citing_paper":"/paper/2606.20210"},"observation_digest":"sha256:219be3a5d724bb5cf5c43eaa8df7936108fb4c2b2068c8b7634471101ec52974","observation_id":"14f042d4-1307-49d6-97bf-4b15bc080217","resolution":{"observed_at":"2026-07-04T03:59:33.006014Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.01016/citation-record","integrity":"/paper/2506.01016/integrity","json":"/paper/2506.01016/citation-record.json","paper":"/paper/2506.01016"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-08-15T04:53:45.483331Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-07T11:55:33.259116Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:33.259116Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:60d468840f5a647ad2c9d600b54ec10fc51c2c18f452690397f9739354676c08","observation_id":"17795620-62f7-4b1c-9600-6922e3bcd169","resolution":{"observed_at":"2026-08-07T11:55:33.259116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:46.288365Z","title":"Unbiased Asymmetric Reinforcement Learning under Partial Observability","venue":null,"work_id":"57e4bd28-337e-4d48-9017-71a68f656d75","year":2022},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:33.314941Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:46ed8a3dc84ad5966792a80ea8d2063513ec8d43fa7cbb615e944c3e5f1f35fa","observation_id":"65ec9b92-323d-4c96-8375-d609f892ca8e","resolution":{"observed_at":"2026-08-07T11:55:46.423413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:46.139633Z","title":"On the consistency of hyper-parameter selection in value-based deep reinforcement learning","venue":null,"work_id":"9f630d7b-ec18-4445-98ba-7b7ec4846890","year":2024},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:33.345999Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:13db065a9c65ced81dbbb0b237976fef36948e41053764d0f3f99cf26b9d9b08","observation_id":"6780b4cb-cbe3-4cb8-bf1a-2471b589c07d","resolution":{"observed_at":"2026-08-07T11:55:46.249024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:45.972418Z","title":"Better exploration with optimistic actor critic","venue":null,"work_id":"c8341975-bf6a-4c8e-9850-fb63408e9474","year":2019},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:33.385797Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:01f2e64be045cf3d6d445b0caabbfd17835207daee7ccf7240173fa81b54d557","observation_id":"e6029c50-c50b-48f7-9495-7b2300851f6f","resolution":{"observed_at":"2026-08-07T11:55:46.051262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:33.460809Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:33.460809Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:e1a830c010bc3836803aa38005ebbb19236150f4d9a11ede5eebfbe27c87575a","observation_id":"8f0e43a7-64f7-47b8-b883-0b99edcad5ef","resolution":{"observed_at":"2026-08-07T11:55:33.460809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:45.811711Z","title":"IMPALA : Scalable Distributed Deep - RL with Importance Weighted Actor - Learner Architectures","venue":null,"work_id":"442517ac-eb2d-4f24-b2f4-0e3d3488769a","year":2018},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:33.535055Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:3cd69a3322f2d8a4f5647f6064daf9364d0a71d8f85bd8f1627b49357309f4d2","observation_id":"a4d8add7-8651-4219-befa-3d95af31a67d","resolution":{"observed_at":"2026-08-07T11:55:45.891823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:45.643842Z","title":"On Interpretability of Artificial Neural Networks : A Survey","venue":null,"work_id":"006d3da5-57af-4592-8bac-85d6d26c8003","year":2021},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:33.628170Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:2f9c244ecd64f69c3067b9e3ac9d5ab860d273d35b618b577b39875120a58914","observation_id":"ba9913be-a823-4ec5-9368-2eadd41cb778","resolution":{"observed_at":"2026-08-07T11:55:45.717700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:45.472030Z","title":"Foundation models in robotics: Applications , challenges, and the future","venue":null,"work_id":"581d813f-f35a-456a-910b-1f0c63bf3809","year":2024},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:33.710695Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:55c73372d9c0ef5cbc6b32c5395a152f918b99443969c6134d82af6754a9012e","observation_id":"662793bf-1b08-424e-a92d-0acc48e038c8","resolution":{"observed_at":"2026-08-07T11:55:45.570205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:45.294965Z","title":"Addressing function approximation error in actor-critic methods","venue":null,"work_id":"8748c7e1-8530-43e3-9972-72742bf89f83","year":2018},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:33.787615Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:4613a2f78af79183289226cc34403577007a09bfe9fea1823a6e78e51b05bb2f","observation_id":"c7bf2f58-69b4-4297-8b29-ba8b5c5c2b10","resolution":{"observed_at":"2026-08-07T11:55:45.390687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:45.131703Z","title":"Soft Actor - Critic : Off - Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor","venue":null,"work_id":"84747153-1be9-4241-b9f4-a121790b92d7","year":2018},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:33.880214Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:24231228f08f6e6fac11939230884a167265c18493995ea1902e97cfea3ba093","observation_id":"71483561-9345-49c7-9640-f1cad966575b","resolution":{"observed_at":"2026-08-07T11:55:45.211698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-17T07:51:41.384508Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-07T11:55:34.022170Z","title":"Soft actor-critic algorithms and applications","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:34.022170Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:4bffab6db887d6a6262e8b0c60d9263166f9e59514c5554e9e713be7430ff6d4","observation_id":"90e73314-5b08-416d-8f4d-5a11b20291dd","resolution":{"observed_at":"2026-08-07T11:55:34.022170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:34.271463Z","title":"Array programming with numpy","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:34.271463Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:644bd9b3a9070f775a69db9b19c187fee9e035946d93daed09e1f21e2c2385ed","observation_id":"94482e09-e2cc-46de-86ee-826d9f0c8514","resolution":{"observed_at":"2026-08-07T11:55:34.271463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:44.916424Z","title":"Double q-learning","venue":null,"work_id":"e4941b79-d3e2-4a3f-8ad2-fe1708f2310c","year":2010},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:34.375055Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:e89720abbb4d747e472b10121a0f1b4077774c57603af5c5997ac86b575fda95","observation_id":"957529bd-0e4e-4bcd-8c98-0f1b7d7b595f","resolution":{"observed_at":"2026-08-07T11:55:45.025962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:44.713093Z","title":"Deep reinforcement learning with double q-learning","venue":null,"work_id":"d612289c-201f-48fa-ad70-bd5941959ec7","year":2016},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:34.438509Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:6f5b0463bc87d838f1747ab328f7b583365f0fa0aef2dbc4cc63ff138280d0a4","observation_id":"b0f27cd7-b467-4c8f-9860-11d284b9a827","resolution":{"observed_at":"2026-08-07T11:55:44.811818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:34.493059Z","title":"Wd3: Taming the estimation bias in deep reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:34.493059Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:b67c8099b5ea2a007a19d94423c536dc748ced4c0b5c4a350cd439329d49f793","observation_id":"2f9f39f6-412e-43f0-a1d1-ba01ef144007","resolution":{"observed_at":"2026-08-07T11:55:34.493059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T11:55:34.590388Z","title":"Hinton, Oriol Vinyals, and Jeffrey Dean","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:34.590388Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:8c7bd82c7cc5b5aa8f05a81bcca3afa98eedf91740cc2bc02c64c44f567d77e3","observation_id":"edb555c0-3c3a-4e5f-b9c1-5dfc15a2a0ab","resolution":{"observed_at":"2026-08-07T11:55:34.590388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:44.528027Z","title":"Toward General - Purpose Robots via Foundation Models : A Survey and Meta - Analysis , October 2024","venue":null,"work_id":"d60d9052-d800-494e-898a-2104e0b01ef0","year":2024},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:34.672623Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:e98c7650ff45dbeeb1f924be07a1f0871951da068d8d59c6e1a487edccc4e045","observation_id":"e90a5005-c23a-4336-a4da-7e2caf6dc3e5","resolution":{"observed_at":"2026-08-07T11:55:44.617173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:44.370618Z","title":"Matplotlib: A 2d graphics environment","venue":null,"work_id":"a5fbe059-35af-4199-a583-2e64eac85c00","year":2007},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:34.773505Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:7d65d8f205ec6469ec39fd06296524d8682cfb4a4cd0c4f49c8845b526e985f7","observation_id":"f80ed92f-b878-45e5-9080-ed54ac5a4be3","resolution":{"observed_at":"2026-08-07T11:55:44.435346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:44.186690Z","title":"Langevin soft actor-critic: Efficient exploration through uncertainty-driven critic learning","venue":null,"work_id":"26799cb4-f324-4602-9216-8cf825ec9749","year":2025},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:34.832652Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:b8ba12babe060b5ef8f744dd5fd070d761eb21a0eecbdc594315d9732ad6f496","observation_id":"1969f05e-e60b-478d-9850-0bbe28cad80d","resolution":{"observed_at":"2026-08-07T11:55:44.270302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:44.035503Z","title":"Littman, and Anthony R","venue":null,"work_id":"bb0abc5e-d5de-430d-89eb-43a42107577f","year":1998},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:34.920931Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:cb387b7c00b820ff20f9c1c0592771200b45a25b79c48394725e47a251a9d9cd","observation_id":"502f7a6f-107d-4293-b0d4-e88327052d1e","resolution":{"observed_at":"2026-08-07T11:55:44.121157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04832","last_updated":"2026-04-18T13:11:19Z","snapshot_observed_at":"2026-08-07T20:09:01.472991Z","submitted_at":"2024-11-07T16:13:54Z","title":"Plasticity Loss in Deep Reinforcement Learning: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04832","snapshot_observed_at":"2026-08-07T11:55:34.984680Z","title":"Plasticity loss in deep reinforcement learning: A survey, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:34.984680Z"},"links":{"cited_paper":"/paper/2411.04832","citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:12fe91cbe24a07aa44888205cdb30b2bd5a9cf6fc190988ebb31445e097f1735","observation_id":"bbf3244c-909a-4708-844e-304d42397f75","resolution":{"observed_at":"2026-08-07T11:55:34.984680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:35.075534Z","title":"Jupyter Notebooks a publishing format for reproducible computational workflows","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:35.075534Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:407067902440629e32b8f382c9152dca11a9c58bdc741f316e8649b4df5a6dfc","observation_id":"9e72630b-85b3-4cfe-82d5-2b3631d01cba","resolution":{"observed_at":"2026-08-07T11:55:35.075534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:43.900961Z","title":"JAXRL: Implementations of Reinforcement Learning algorithms in JAX , 10 2021","venue":null,"work_id":"89fb96fb-3b39-4d24-9d01-f7ecada30d0b","year":2021},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:35.152771Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:60c6b7112e117ea75ecf15abd2f65ca10fe35cf25d10d1d07316ba564c75f2fa","observation_id":"10b60089-1398-447a-a2bb-65874c482765","resolution":{"observed_at":"2026-08-07T11:55:43.957269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:35.237383Z","title":"Implicit under-parameterization inhibits data-efficient deep reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:35.237383Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:cb2bad0faa222a76c6b295a44cfa516e3d076f9850c32cbcfa20f9e5ec453b4d","observation_id":"aa3051b2-d837-4807-b994-4555f733270d","resolution":{"observed_at":"2026-08-07T11:55:35.237383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:43.714232Z","title":"Maintaining plasticity in continual learning via regenerative regularization, 2024","venue":null,"work_id":"3ddbe717-106d-4e86-97b6-3ef7d3e6e9b6","year":2024},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:35.311750Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:69b264b7a049c442c2476345cac1bdb5deca8ef0d1fbb5367bc7d4aef32b8202","observation_id":"e61c4044-ac29-400c-b94b-c2fd4e8076da","resolution":{"observed_at":"2026-08-07T11:55:43.816526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10466","last_updated":"2023-04-20T17:11:05Z","snapshot_observed_at":"2026-08-17T04:44:07.054471Z","submitted_at":"2023-04-20T17:11:05Z","title":"Efficient Deep Reinforcement Learning Requires Regulating Overfitting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10466","snapshot_observed_at":"2026-08-07T11:55:35.378696Z","title":"Efficient deep reinforcement learning requires regulating overfitting, 2023 a","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:35.378696Z"},"links":{"cited_paper":"/paper/2304.10466","citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:8f3cba8a3e7c57d25841c7e538534bff38232505214c68f122c2f696108e40e7","observation_id":"8f19ce19-a2db-4b84-8382-b03ccde148e8","resolution":{"observed_at":"2026-08-07T11:55:35.378696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:35.470015Z","title":"Realistic actor-critic: A framework for balance between value overestimation and underestimation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:35.470015Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:d44169c8be3309a68ecd49480e2e1d3d052b33ac9b7d8676706d6fe5b48799d5","observation_id":"ecf3329d-94e2-40bb-ab72-b9cbe100b190","resolution":{"observed_at":"2026-08-07T11:55:35.470015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:43.494805Z","title":"Interpretable deep learning: interpretation, interpretability, trustworthiness, and beyond","venue":null,"work_id":"a053e24f-49bb-4f20-9643-1df97d865b1b","year":2022},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:35.544960Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:def96f873269913153c707761a09fe291a1ec3a4085034aa0974e3209d393502","observation_id":"a65aa76d-020b-4176-b609-3d3fe1e356b2","resolution":{"observed_at":"2026-08-07T11:55:43.587345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-16T22:06:26.835611Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-07T11:55:35.640158Z","title":"Lillicrap, Jonathan J","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:35.640158Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:23747dd0e7c508774956cfb47f961a462f6a55f47ae3d3b80e909c500097d96f","observation_id":"259541eb-3547-4881-8115-f9b54b9a9669","resolution":{"observed_at":"2026-08-07T11:55:35.640158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:43.192264Z","title":"Visual whole-body control for legged loco-manipulation","venue":null,"work_id":"652af997-d9fd-42de-9214-f113501f826f","year":2024},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:35.714229Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:1e31f7580b9749edbba9d6bd008f5aa044218ecd224d31b9a60b94c37187e491","observation_id":"e7219061-ba74-43af-91ae-2abbb810e6cf","resolution":{"observed_at":"2026-08-07T11:55:43.321129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:42.823770Z","title":"Regularization matters in policy optimization - an empirical study on continuous control","venue":null,"work_id":"3c6a2586-d89b-4fde-a30f-ce44c84e8334","year":2021},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:35.781444Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:d9eb83f6e45d72b1fe71d5a79865f141bffafe84d0fecbedb0ec6644d7d9d188","observation_id":"26cd8e57-9dd9-4940-9cf5-1d8f11302c2d","resolution":{"observed_at":"2026-08-07T11:55:43.031740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18762","last_updated":"2024-02-29T00:02:33Z","snapshot_observed_at":"2026-08-20T12:19:12.215906Z","submitted_at":"2024-02-29T00:02:33Z","title":"Disentangling the Causes of Plasticity Loss in Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18762","snapshot_observed_at":"2026-08-07T11:55:35.870576Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:35.870576Z"},"links":{"cited_paper":"/paper/2402.18762","citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:ff3df0210af825fb062f5e51383576819a66e7a57e8ae9a0ad422082b26bdc07","observation_id":"b294bd34-7aae-43f8-bf3d-a6a08fc3cd21","resolution":{"observed_at":"2026-08-07T11:55:35.870576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:42.490746Z","title":"A deeper understanding of state-based critics in multi-agent reinforcement learning","venue":null,"work_id":"a134854b-d935-49b7-9813-fa442076da09","year":2022},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:35.983032Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:c471ba3d973cd9e7ee01488507fdc5956061eb4f1daa23515a9a1e7acba4ebb2","observation_id":"f0baf1f4-1bdc-4b9f-adaa-087ce8c87592","resolution":{"observed_at":"2026-08-07T11:55:42.659343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:42.218044Z","title":"Revisiting Plasticity in Visual Reinforcement Learning : Data , Modules and Training Stages","venue":null,"work_id":"18a5a5f2-dbc2-41f9-89ba-016cd1f9d376","year":2023},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:36.057332Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:bca71300d1ce51a7ea890d1a3b9f772bf699026f3bfacffaef16cf60b3d1d7c9","observation_id":"44874a25-c109-44b7-b6f4-b81d783febf5","resolution":{"observed_at":"2026-08-07T11:55:42.338466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:36.164344Z","title":"Python for Data Analysis: Data Wrangling with Pandas, NumPy , and IPython","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:36.164344Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:5499f72257f8747ad35aa5ee02fc54dfb931003bd22969517bdb7e7305040e3b","observation_id":"82053962-a8dc-4427-9fcc-3747010bdc44","resolution":{"observed_at":"2026-08-07T11:55:36.164344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:41.959393Z","title":"Spectral normalization for generative adversarial networks","venue":null,"work_id":"40ab7bf1-6d90-4a29-b52b-a8272242ec67","year":2018},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:36.264920Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:5a9d5e3c2f82641bbda2901029603709d7ee5bba0fed346be92d89f80d5ef6e3","observation_id":"d3a5c5dc-6d26-4df7-a87f-760793d07161","resolution":{"observed_at":"2026-08-07T11:55:42.073868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:36.338454Z","title":"Rusu, Joel Veness, Marc G","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:36.338454Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:2b0e6c2f21bdc3887476a071214fba42bfc161a22424e8dfa747386ba0c02c42","observation_id":"799dc7b4-794d-48ce-b26c-03e220baf998","resolution":{"observed_at":"2026-08-07T11:55:36.338454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:41.736952Z","title":null,"venue":null,"work_id":"9681cd17-9cfa-4675-aa03-37469007aef4","year":2021},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:36.417205Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:627a78e2f9ec0c1bf4b83cacda0f75ec015386f485a7bcc80fb886f939d28138","observation_id":"1362fe37-2149-4dd1-bac9-c3bb51e0255c","resolution":{"observed_at":"2026-08-07T11:55:41.849400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:41.398859Z","title":"Overestimation, overfitting, and plasticity in actor-critic: the bitter lesson of reinforcement learning","venue":null,"work_id":"071d7bad-d1ad-493f-bf1e-4089b114778b","year":2024},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:36.475980Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:1457eac0b013e2c067d89999bf0f3aa9f0acc0a078268e41aad0e9ec16ae1f71","observation_id":"17b99e03-460c-43cd-aa12-1b340a2dd4b3","resolution":{"observed_at":"2026-08-07T11:55:41.588978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:41.128130Z","title":"The Primacy Bias in Deep Reinforcement Learning","venue":null,"work_id":"64b48072-d39a-43d7-a972-35faab6f698a","year":2022},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:36.536320Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:acc27be3550c2dc52be8c4d8b8ef358abd3dd4789dd6778907a0a9f4387f2299","observation_id":"706f6f4a-30c5-46d2-85cc-9a43b9beccab","resolution":{"observed_at":"2026-08-07T11:55:41.251186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:36.605694Z","title":"Oliphant","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:36.605694Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:13bb9e46b394da255faaabc1b02bda19400746d7fdbc538d3175518435bf9d19","observation_id":"7130d1e9-240d-4166-a1ea-c1f89b9eb2ad","resolution":{"observed_at":"2026-08-07T11:55:36.605694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:40.897415Z","title":"The difficulty of passive learning in deep reinforcement learning","venue":null,"work_id":"c6c9a607-f9db-48b3-a4dd-2da253012875","year":2021},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:36.713250Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:ba6b8b28ae69e4d23cbda6190ecc052a37b43da6a218f86fe6c82a7ba91576a9","observation_id":"8fb29f38-1a84-40d9-b879-c62289eae17b","resolution":{"observed_at":"2026-08-07T11:55:41.010323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:40.653569Z","title":"Puterman","venue":null,"work_id":"9ceb2410-d273-472a-92e5-06928e3eb50c","year":1994},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:36.825600Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:25656063a9404f417002472c249f27aa8dcc620f2115ed91f5ccdb4668d3a769","observation_id":"dbded42b-128d-4219-9673-61a4d3648590","resolution":{"observed_at":"2026-08-07T11:55:40.729052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06295","last_updated":"2016-01-07T18:43:03Z","snapshot_observed_at":"2026-08-18T00:03:21.764059Z","submitted_at":"2015-11-19T18:38:47Z","title":"Policy Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06295","snapshot_observed_at":"2026-08-07T11:55:36.884270Z","title":"Rusu, Sergio Gomez Colmenarejo, Caglar Gulcehre, Guillaume Desjardins, James Kirkpatrick, Razvan Pascanu, Volodymyr Mnih, Koray Kavukcuoglu, and Raia Hadsell","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:36.884270Z"},"links":{"cited_paper":"/paper/1511.06295","citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:bcbbd4fc029feae9346e4225ecfd806f0287e4e5d187518c0fdd7cbe9b747fea","observation_id":"d0574751-54a6-448f-a077-8cde03e56987","resolution":{"observed_at":"2026-08-07T11:55:36.884270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:40.398243Z","title":"A Large Recurrent Action Model : xLSTM enables Fast Inference for Robotics Tasks , February 2025","venue":null,"work_id":"f2772acb-ce67-4b3d-8ce2-fd9d2028da2a","year":2025},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:36.942888Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:7447d33820416d486f9283dfa6133a62983b7708332c183581e6fb978ee8cf7c","observation_id":"1d1d0e81-9034-4cb3-95c9-13a748eaa30a","resolution":{"observed_at":"2026-08-07T11:55:40.524143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:40.223041Z","title":"The dormant neuron phenomenon in deep reinforcement learning","venue":null,"work_id":"61697520-cc13-4efd-8f1e-e0d14a821e92","year":2023},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:36.998424Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:6d594731a48750fddcdd818702627555f3118e33929a22da40479854576d4567","observation_id":"4e657674-4a72-4e04-84ba-69e1e299c8b6","resolution":{"observed_at":"2026-08-07T11:55:40.285320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:39.908375Z","title":"Maxinforl: Boosting exploration in reinforcement learning through information gain maximization","venue":null,"work_id":"1e967b8e-92c8-47fa-82ad-9521d00ec570","year":2025},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:37.087674Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:3582d07bd49e36148c958136680f79507656591a98ec1d41a2e2b1b14d384960","observation_id":"f8e465a3-7284-4237-b01c-60d8dbf6032b","resolution":{"observed_at":"2026-08-07T11:55:40.079940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:37.157121Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:37.157121Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:7cd8b68e7c2465e83d997231f9b8f6db91d1ed3eceeeb4f8dac91b8b3e2220cd","observation_id":"41224d05-b36b-4e4f-94af-9427755e1842","resolution":{"observed_at":"2026-08-07T11:55:37.157121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:39.636470Z","title":"Deep Reinforcement Learning for Robotics : A Survey of Real - World Successes","venue":null,"work_id":"090bdd4a-6ce6-4652-a6fe-6499dc853b66","year":2024},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:37.200672Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:976b05ce81929966b46c01d4a3c9e975ba8cbb002d78dcb5c35d98acb44ba849","observation_id":"73e19dfd-650c-4e01-b432-88e10f50d592","resolution":{"observed_at":"2026-08-07T11:55:39.769929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:39.437266Z","title":"DeepMind Control Suite , January 2018","venue":null,"work_id":"1cd6fa50-770e-4b6c-ac0e-7fde393303ca","year":2018},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:37.266076Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:be3f5d7f4d7ab87fa741fdec5ca49253a715f896382d3f7b18a9754dadaa51af","observation_id":"ad5ee0e2-f0f1-464e-a1d3-62cefd296306","resolution":{"observed_at":"2026-08-07T11:55:39.501265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:39.224085Z","title":"dm\\_control: Software and tasks for continuous control","venue":null,"work_id":"b575c70e-472e-4d3e-b863-b2b237a76632","year":2020},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:37.338977Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:b902f5ff88e5138747a64276840748b35ac9c99486a76540dd04efd182bb59f1","observation_id":"d203f2e4-45b7-40c1-8266-3b19cc5d3ca7","resolution":{"observed_at":"2026-08-07T11:55:39.349161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05350","last_updated":"2017-06-16T17:08:08Z","snapshot_observed_at":"2026-08-16T22:00:20.852295Z","submitted_at":"2017-06-16T17:08:08Z","title":"L2 Regularization versus Batch and Weight Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05350","snapshot_observed_at":"2026-08-07T11:55:37.396739Z","title":"L2 regularization versus batch and weight normalization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:37.396739Z"},"links":{"cited_paper":"/paper/1706.05350","citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:02ac555c2b521b41919b64c8c77d2ee4c428d8c7c45648ce0c975b0109807382","observation_id":"26c91935-1d70-4151-b8f3-0b46687b5b16","resolution":{"observed_at":"2026-08-07T11:55:37.396739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:39.086531Z","title":"Python reference manual","venue":null,"work_id":"5a979540-3f26-4d2e-ba3b-da4b61b4df24","year":1995},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:37.453484Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:f5fc1391780d5cdc01da11058af2407c9e64c40eb791f53bab9aed1af6bfef5d","observation_id":"9d058ddd-0cdd-4778-89cd-da599af9ef70","resolution":{"observed_at":"2026-08-07T11:55:39.142846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:38.931405Z","title":"Wurman, and Peter Stone","venue":null,"work_id":"f0b73b4f-922c-4f40-aabd-eea0dab2dc48","year":2024},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:37.497926Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:2b4fc1f0daa1045649232e256fc7e7a5a612acdbf369154475c0fc2aec4723aa","observation_id":"c3fcd11f-ded1-4626-98c4-546dcbc73576","resolution":{"observed_at":"2026-08-07T11:55:39.023870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:38.764078Z","title":"Motion planning and control for mobile robot navigation using machine learning: a survey","venue":null,"work_id":"6d729030-6a3c-472b-908b-63455f3255c5","year":2022},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:37.560554Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:9190b7b110db39743608f29833decd474f9562baca6381773ab8b58d0cb4a426","observation_id":"ea71a7c1-a3e2-4fc0-b3a0-2db623dbe9af","resolution":{"observed_at":"2026-08-07T11:55:38.831973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:38.596424Z","title":"Benchmarking Reinforcement Learning Techniques for Autonomous Navigation","venue":null,"work_id":"d189471d-403b-44e4-b517-d2191abc98a2","year":2023},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:37.614831Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:3420686818c47bf7a2ee757b74d72fd00ae7a79ef33a354fe50ee0385f80d8d3","observation_id":"967af573-a0d7-4893-8eff-c3cdc5527063","resolution":{"observed_at":"2026-08-07T11:55:38.663638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:38.436161Z","title":"Improving sample efficiency in model-free reinforcement learning from images, 2020","venue":null,"work_id":"8a3d4530-5130-4f2b-aa57-56e8f5b2f43a","year":2020},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:37.669492Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:b97ddc9a502ec8e81705149ce5cd9ce93275ec025c1ba563526d332037e2eda6","observation_id":"f96fee66-de3a-4fca-b22f-ec3f370983d7","resolution":{"observed_at":"2026-08-07T11:55:38.477207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:38.298836Z","title":"Image augmentation is all you need: Regularizing deep reinforcement learning from pixels","venue":null,"work_id":"f8044814-7507-4abf-ad8b-eb9f039b1f43","year":2021},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:37.725848Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:a461bb782d393e6d4851278507a397977f9a5b2a102f2039b94c2ad9c431f623","observation_id":"a3cd9db7-0b4c-4714-b52e-720f47ea6543","resolution":{"observed_at":"2026-08-07T11:55:38.363798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:37.787566Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:37.787566Z"},"links":{"citing_paper":"/paper/2506.01016"},"observation_digest":"sha256:532f42deb8fdf45cad6f7ed94431c5278f08612c20bfee72cd0e0065390fa529","observation_id":"ce5e4aba-2621-48f4-9382-3532faa6a304","resolution":{"observed_at":"2026-08-07T11:55:37.787566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.01016","last_updated":"2025-08-14T15:32:40Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T17:57:55.690422Z","submitted_at":"2025-06-01T14:00:03Z","title":"Optimistic critics can empower small actors"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":38},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 1 inbound Pith citation observation for arXiv:2506.01016."}