{"as_of":"2026-08-08T04:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:72f09a45ff33bd9289f800c6fa0df3dff97226a0aa35af947accc88affe3da59","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T08:51:17.043206Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.19397/citation-record","integrity":"/paper/2607.19397/integrity","json":"/paper/2607.19397/citation-record.json","paper":"/paper/2607.19397"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:51:15.934581Z","title":"nature518(7540), 529–533 (2015)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:15.934581Z"},"links":{"citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:fb6871019d7a48270f14f1c60d2094ed34468f369394811a5dbee52867073dda","observation_id":"de18760f-e064-47e9-aced-5d24ca98b8a6","resolution":{"observed_at":"2026-08-02T08:51:15.934581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-02T08:51:16.010378Z","title":"arXiv preprint arXiv:1312.5602 (2013)","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:16.010378Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:cec52da9d7042c2362ede5f176bc05dfc006af92cbdd7e42989e26cf0b4ec6b4","observation_id":"27f69fc0-91d3-49c2-89cf-ca407ad0460f","resolution":{"observed_at":"2026-08-02T08:51:16.010378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:51:16.116131Z","title":"In: Learning for Dynamics and Control, pp","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:16.116131Z"},"links":{"citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:a393804729014164243045510ee7634d4543367a3c825e99bf7b39195f62fe7d","observation_id":"bc063bf2-8af5-47ee-931e-f3e6a40abde4","resolution":{"observed_at":"2026-08-02T08:51:16.116131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.07510","last_updated":"2019-02-07T22:11:51Z","snapshot_observed_at":"2026-08-07T20:52:30.231852Z","submitted_at":"2019-01-22T18:38:04Z","title":"Understanding Multi-Step Deep Reinforcement Learning: A Systematic Study of the DQN Target","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.07510","snapshot_observed_at":"2026-08-02T08:51:16.267768Z","title":"arXiv preprint arXiv:1901.07510 (2019)","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:16.267768Z"},"links":{"cited_paper":"/paper/1901.07510","citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:58df994793406446236a2505c732261e052c5ca75d117ae806e8fa47d92d0c46","observation_id":"6a4f00f1-2ce8-4570-a95d-3f9413ee3c41","resolution":{"observed_at":"2026-08-02T08:51:16.267768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.02648","last_updated":"2018-12-06T16:36:20Z","snapshot_observed_at":"2026-07-06T07:19:38.028327Z","submitted_at":"2018-12-06T16:36:20Z","title":"Deep Reinforcement Learning and the Deadly Triad","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.02648","snapshot_observed_at":"2026-08-02T08:51:16.375111Z","title":"arXiv preprint arXiv:1812.02648 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:16.375111Z"},"links":{"cited_paper":"/paper/1812.02648","citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:249929bcb32ee8110e3745591f6aaf726cbc659a95446660627a432a93572487","observation_id":"6fef3440-7959-4a7e-84f6-016b71815860","resolution":{"observed_at":"2026-08-02T08:51:16.375111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.09560","last_updated":"2022-05-04T14:50:26Z","snapshot_observed_at":"2026-08-03T20:56:03.618011Z","submitted_at":"2022-04-20T15:55:15Z","title":"Understanding and Preventing Capacity Loss in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.09560","snapshot_observed_at":"2026-08-02T08:51:16.467225Z","title":"arXiv preprint arXiv:2204.09560 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:16.467225Z"},"links":{"cited_paper":"/paper/2204.09560","citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:857681331a0aa5a5d336350a92bb019e73f5918abcf09b4c56fdc1cd68dd99a5","observation_id":"b15736b1-ef4e-4de5-8fd5-5f056a3e76c6","resolution":{"observed_at":"2026-08-02T08:51:16.467225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:51:16.534381Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:16.534381Z"},"links":{"citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:8f18ca5dae80edb94d2ea5a04f387f3f4cb0f2e92a1874310e830792925cadf9","observation_id":"494d3c43-0e25-40ef-9d55-e59f3e8fcdad","resolution":{"observed_at":"2026-08-02T08:51:16.534381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:51:16.687971Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:16.687971Z"},"links":{"citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:5e8f5fbb9849485d977cdf0aa72a1a7a90bc1bcefbc09e70bba2cf0d3e9f8249","observation_id":"b8d94531-4d36-4433-ac82-77f3dfd45f21","resolution":{"observed_at":"2026-08-02T08:51:16.687971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:51:16.800987Z","title":"In: Uncertainty in Artificial Intelligence Workshop on Uncertainty in Deep Learning (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:16.800987Z"},"links":{"citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:91f19fbbaa35adf4a1545a8bb093703593a0093199ad724726149aa03ccef8c8","observation_id":"1197497d-a717-49f6-854c-351490334ed5","resolution":{"observed_at":"2026-08-02T08:51:16.800987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-02T08:51:16.921699Z","title":"arXiv preprint arXiv:1509.02971 (2015)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:16.921699Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:12df100636395bd1354a7af26fcfd30deabd6eb90c7925f020dac1162cadab04","observation_id":"9dc1c19f-a641-460f-b256-a829623950d0","resolution":{"observed_at":"2026-08-02T08:51:16.921699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:51:16.990040Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:16.990040Z"},"links":{"citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:8bcc22b4490b52aec100281342cddfaa430d9bd62f84a5f1a3986db741c7778a","observation_id":"39101a50-030b-434a-8518-7e7801c455cd","resolution":{"observed_at":"2026-08-02T08:51:16.990040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:51:16.994302Z","title":"In: 17 International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:16.994302Z"},"links":{"citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:2292bd43485e9b57ed3482cadc6b592ac8a855da731f31bf431d425acba60264","observation_id":"3ca5855c-c39e-4989-976b-c3d976f8bc22","resolution":{"observed_at":"2026-08-02T08:51:16.994302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:51:16.998860Z","title":"In: International Conference on Machine Learning, pp","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:16.998860Z"},"links":{"citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:bba132da1967f351d1092b032ffd8fab5d31c0a996ba4026845c2611dcc146ab","observation_id":"dbde4dde-87cc-4428-8d3e-4a19a9f86d64","resolution":{"observed_at":"2026-08-02T08:51:16.998860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:51:17.003452Z","title":"Advances in Neural Information Processing Systems35, 17703–17716 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:17.003452Z"},"links":{"citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:644391f1daea34dc7b8355a503af4fba8e4702e2343270b045b77373e239ad08","observation_id":"3c037691-866e-4791-b487-80e4377eb9ea","resolution":{"observed_at":"2026-08-02T08:51:17.003452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04811","last_updated":"2025-04-21T20:21:44Z","snapshot_observed_at":"2026-08-03T05:46:16.330368Z","submitted_at":"2024-07-05T18:49:07Z","title":"Simplifying Deep Temporal Difference Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04811","snapshot_observed_at":"2026-08-02T08:51:17.007544Z","title":"arXiv preprint arXiv:2407.04811 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:17.007544Z"},"links":{"cited_paper":"/paper/2407.04811","citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:97fe10cec34720b301e7b9079a68d4a19d4b0a7f2f0d264c91145fa5978b6582","observation_id":"3aef960c-934a-4938-8528-e304a4dd1541","resolution":{"observed_at":"2026-08-02T08:51:17.007544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05407","last_updated":"2019-02-25T14:18:11Z","snapshot_observed_at":"2026-07-31T19:09:21.589864Z","submitted_at":"2018-03-14T17:09:27Z","title":"Averaging Weights Leads to Wider Optima and Better Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05407","snapshot_observed_at":"2026-08-02T08:51:17.011972Z","title":"arXiv preprint arXiv:1803.05407 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:17.011972Z"},"links":{"cited_paper":"/paper/1803.05407","citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:cdd930b8c9b7167710a305bdad7a08dc46b9c170d0c5c014e3d733883b3fc7f9","observation_id":"904f1cdf-1fc4-482e-8d29-ec178fd09b9b","resolution":{"observed_at":"2026-08-02T08:51:17.011972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:51:17.016286Z","title":"In: Proceedings of the European Conference on Computer Vision (ECCV), pp","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:17.016286Z"},"links":{"citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:9c900d45fa8e51410307840672c1127df9622d1bdbb72e2b1900559c9a563525","observation_id":"c652b0d4-0148-4092-a8c1-6022c9a43563","resolution":{"observed_at":"2026-08-02T08:51:17.016286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:51:17.020818Z","title":"Journal of Machine Learning Research23(274), 1–18 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:17.020818Z"},"links":{"citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:e6e0e3c9c797ac36404e64c406fc11d67a61d9a1417bc6e1d8c43ec96412bddf","observation_id":"d49eb7ca-38ac-4d78-8ca1-41223131e6a4","resolution":{"observed_at":"2026-08-02T08:51:17.020818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:51:17.024980Z","title":"Advances in Neural Information Processing Systems38(2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:17.024980Z"},"links":{"citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:3f1817a74b999424209cd3a55715890aee3851aba0da1779ff18eead480be8d8","observation_id":"fca750f4-d18b-4c44-a8dc-cef602c5d5de","resolution":{"observed_at":"2026-08-02T08:51:17.024980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-02T08:51:17.029283Z","title":"arXiv preprint arXiv:1607.06450 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:17.029283Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:efb90d20196037389b62765f74a85c55b443fbbad0dd6aa6518db941eeb6addf","observation_id":"aa69fea0-4a5a-4dc7-a5ed-1f27a36e6da0","resolution":{"observed_at":"2026-08-02T08:51:17.029283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00514","last_updated":"2024-06-19T11:32:01Z","snapshot_observed_at":"2026-07-06T17:38:04.972649Z","submitted_at":"2024-03-01T13:25:10Z","title":"Overestimation, Overfitting, and Plasticity in Actor-Critic: the Bitter Lesson of Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00514","snapshot_observed_at":"2026-08-02T08:51:17.033858Z","title":"arXiv preprint arXiv:2403.00514 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:17.033858Z"},"links":{"cited_paper":"/paper/2403.00514","citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:8e15be38087c494b9ecf5ab82dea5d42d9cd71f9f292c19c922d4a1d928cf37d","observation_id":"d6fde913-fe6b-47d7-b25d-6c1a436a441f","resolution":{"observed_at":"2026-08-02T08:51:17.033858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03758","last_updated":"2025-06-04T09:24:17Z","snapshot_observed_at":"2026-08-07T10:53:27.145888Z","submitted_at":"2025-06-04T09:24:17Z","title":"Scaling CrossQ with Weight Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03758","snapshot_observed_at":"2026-08-02T08:51:17.038597Z","title":"arXiv preprint arXiv:2506.03758 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:17.038597Z"},"links":{"cited_paper":"/paper/2506.03758","citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:db9b86c6d5a4eaba3ab4544a046681a15a11daa790ffb6899202686b88c2f563","observation_id":"102d8910-45df-4d31-9be8-23a7c37a95ef","resolution":{"observed_at":"2026-08-02T08:51:17.038597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T08:51:17.043206Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T08:51:17.043206Z"},"links":{"citing_paper":"/paper/2607.19397"},"observation_digest":"sha256:01bb8164908137557ba7b953b44e49b1d97aca287632b359a63411d3797247c1","observation_id":"81088ef8-7965-41f1-b1fc-0f816f23f8da","resolution":{"observed_at":"2026-08-02T08:51:17.043206Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19397","last_updated":"2026-07-04T05:45:32Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T17:40:18.629969Z","submitted_at":"2026-07-04T05:45:32Z","title":"Memory Merge DQN: Sensitivity Weighted Target Updates for Stable Value Learning"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2607.19397."}