{"as_of":"2026-08-03T04:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2cc6329c13396c69a55c55e37b164ee688a59b7726f265d2f2fef80796fda8cb","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T10:36:32.096050Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-02T06:30:47.504484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T06:35:59.192049Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27063","snapshot_observed_at":"2026-08-02T06:35:59.192049Z","title":": Incremental self-improvement. In Proc. Workshop on Genetic Programming at ML95, pp. 42–49, 1995. Jürgen Schmidhuber. What","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13104","last_updated":"2026-07-14T09:12:57Z","snapshot_observed_at":"2026-08-02T06:35:49.441459Z","submitted_at":"2026-07-14T09:12:57Z","title":"Self-Improvements in Modern Agentic Systems: A Survey","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T06:35:59.192049Z"},"links":{"cited_paper":"/paper/2604.27063","citing_paper":"/paper/2607.13104"},"observation_digest":"sha256:6b9914642786f309831145dd77863c8981f5b3b85e3e06988ab238f399b7e296","observation_id":"fa7d2894-44a9-4820-8818-d850ac034b5b","resolution":{"observed_at":"2026-08-02T06:35:59.192049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.27063/citation-record","integrity":"/paper/2604.27063/integrity","json":"/paper/2604.27063/citation-record.json","paper":"/paper/2604.27063"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:46:43.572403Z","title":"Learning to learn by gradient descent by gradient descent","venue":null,"work_id":"10a07384-39c3-4ed9-9876-b91a06e77edc","year":2016},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:7c11dfde02b204539b8b29e3eca73bee17b508620c0cdeddb58c8079241a3e95","observation_id":"5c3c1824-5c21-4ae4-81ec-0016d4ea9657","resolution":{"observed_at":"2026-05-27T07:38:46.067066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On warm-starting neural network training","venue":null,"work_id":"64807fac-9b73-475b-880b-bea6cdc93804","year":2020},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:32e8354ab503fd2dfbb2fb8511e2edb1a6f93f9057100a3993e7a1502b34fc44","observation_id":"f764b2c8-294e-4863-b796-724a79947bff","resolution":{"observed_at":"2026-05-27T07:38:46.082274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"o ppel, Markus Spanring, Andreas Auer, Oleksandra Prudnikova, Michael Kopp, G \\","venue":null,"work_id":"f7795279-3a11-4b4c-9d71-c12b56172631","year":2024},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:dd1d582ef7ab5f46346b688d98ffbe92cc59fa9e50a09badf79bed52b4ad850e","observation_id":"17ead005-2814-48cf-a619-0994f554d0c7","resolution":{"observed_at":"2026-05-27T07:38:45.906488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emnist: Extending mnist to handwritten letters","venue":null,"work_id":"20426042-af88-4811-9132-b00a38319707","year":2017},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:f766785073a882d662d06414dd2659c4b7e4100093202b9fa8d1b58c1a8039a0","observation_id":"a738f297-53f6-43eb-9289-598fd8d76a53","resolution":{"observed_at":"2026-05-27T07:38:45.980696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17401","last_updated":"2024-01-30T19:35:43Z","snapshot_observed_at":"2026-07-06T17:22:45.506107Z","submitted_at":"2024-01-30T19:35:43Z","title":"Step-size Optimization for Continual Learning","version":1},"cited_work":{"arxiv_id":"2401.17401","doi":"10.48550/arxiv.2401.17401","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.17401","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Step-size optimization for continual learning","venue":null,"work_id":"5e4ed761-3b2a-4bdf-b5ba-0731e2dd7b25","year":2024},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"cited_paper":"/paper/2401.17401","citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:5754176cd81c69fd6c596458a9afc56b406ba29f25af833fa2d2fac155e81b3b","observation_id":"960571c9-fdf4-4ff9-8814-7cb8836711fd","resolution":{"observed_at":"2026-05-12T09:31:26.854064Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Loss of plasticity in deep continual learning","venue":null,"work_id":"52fc12e3-67cc-4240-b0e2-5cf51b91de28","year":2024},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:2345f2cf90871dc76c47f6c663058089350d5307fb018cf2d30654bf39863f28","observation_id":"d081907f-c054-48a8-9962-379eb3691d8d","resolution":{"observed_at":"2026-05-27T07:38:45.910941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rupam Mahmood","venue":null,"work_id":"5db7fcdc-9415-4839-b1b4-edb1ca508f54","year":2024},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:a8dcba21ec3219aef98c0c2539d9e63e27d9762eaaf3e153943453b30df155fa","observation_id":"79c327c3-7751-41b2-9d0e-c3a182add742","resolution":{"observed_at":"2026-05-27T07:38:45.898274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01704","last_updated":"2024-07-01T18:29:29Z","snapshot_observed_at":"2026-07-06T18:39:52.378049Z","submitted_at":"2024-07-01T18:29:29Z","title":"Weight Clipping for Deep Continual and Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2407.01704","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01704","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rupam Mahmood","venue":null,"work_id":"14cbdceb-207d-4ee7-aa42-94b48aa93f6c","year":2024},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"cited_paper":"/paper/2407.01704","citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:75c8d7427ad2739b7da3b4b0021ce06b3e76a78cf76f024024a145101b92aa9a","observation_id":"9765521e-8a8f-427d-a4b2-56f39a9d2c5b","resolution":{"observed_at":"2026-05-12T09:31:26.856993Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Catastrophic forgetting in connectionist networks","venue":null,"work_id":"2d3d8d1b-2261-4e1c-be2a-a030a31d717e","year":1999},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:dd0c0b544920a99e7b9a6935dcdff2cc59f1ba6c53cb6d6874f13b8cb4b5b3d0","observation_id":"c54262ca-ab9f-409a-8ae9-00587ae27d13","resolution":{"observed_at":"2026-05-27T07:38:45.902204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to forget: Continual prediction with LSTM","venue":null,"work_id":"0a2824ec-fb6b-45f2-9d1c-21552e1287b0","year":2000},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:5d8cb6ac13f32c144e6375dba591597e9c3b21303dc26f41eb5bf40dc0b186e1","observation_id":"68f93b41-201e-4a28-840a-d237dd51527f","resolution":{"observed_at":"2026-05-27T07:38:45.926459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving robustness with adaptive weight decay","venue":null,"work_id":"8d972bb0-5ac4-44d2-b054-c2b949966bb3","year":2023},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:88533250bd4e6c94131aba1faa9fbf439e6a742090b403541f178b09e9a91f56","observation_id":"cc58d83e-0870-4f7d-b007-197fa15be499","resolution":{"observed_at":"2026-05-27T07:38:45.956336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Competitive learning: From interactive activation to adaptive resonance","venue":null,"work_id":"0e3e0096-421e-4834-81d2-faab86ddc16d","year":1987},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:591938539fb60772ec625feac5655113a106ab86160712559fb22ef314226d51","observation_id":"b555a8fe-d4f2-484f-b9d9-092643db51b7","resolution":{"observed_at":"2026-05-27T07:38:46.074804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Comparing biases for minimal network construction with back-propagation","venue":null,"work_id":"cd479a65-e785-417a-8755-84ab909c14e7","year":1988},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:88de576a813a34c31dd800cbc8aafec3d11e0ce56d742df7b5bee053b42c9df8","observation_id":"530626f3-d547-4e46-9655-b008e1d4132e","resolution":{"observed_at":"2026-05-27T07:38:45.922664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Alphadecay: Module-wise weight decay for heavy-tailed balancing in LLM s","venue":null,"work_id":"7a4b9674-b205-41e3-a03e-5fe67dedcfe1","year":2025},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:db993e8c2731a796d8190ff4c5d556b5ca17de4823a9e324acf42d9fbb2ae965","observation_id":"edb01388-63c8-490c-947a-20814feabf23","resolution":{"observed_at":"2026-05-27T07:38:45.914668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.00212","last_updated":"2025-08-20T01:53:57Z","snapshot_observed_at":"2026-07-06T22:06:01.492642Z","submitted_at":"2025-07-31T23:25:19Z","title":"Reinitializing weights vs units for maintaining plasticity in neural networks","version":2},"cited_work":{"arxiv_id":"2508.00212","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.00212","snapshot_observed_at":"2026-06-30T11:04:37.510167Z","title":"Reinitializing weights vs units for maintaining plasticity in neural networks","venue":null,"work_id":"49d29979-121d-49fa-bb9c-aa6474007480","year":2025},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"cited_paper":"/paper/2508.00212","citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:44586bbde534844d1e84548fed8f66f89c5ac2280be67f8a344e3557fcb35eb1","observation_id":"5791c06e-ad8a-41a1-baca-9a6b7652fb7a","resolution":{"observed_at":"2026-05-12T09:31:26.860362Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hochreiter and J","venue":null,"work_id":"6bd1b473-5d12-412d-abce-ec27b628fc8f","year":1997},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:d2c4a9a2c47a9e0657dc3599da8890a7d976483165c9e89c4feb24144fa44308","observation_id":"7f21998c-1166-4d32-9da9-9b9dfc8314fc","resolution":{"observed_at":"2026-05-27T07:38:45.988704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to learn using gradient descent","venue":null,"work_id":"e527cd01-3f58-4784-94a1-248ab7d9a14c","year":2001},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:460ab50546ced64374a9b9b924939b8dba9e3a7cefabf3e417869fc607da44eb","observation_id":"30f8bd2a-4edc-437a-bdc8-ccd90375edd3","resolution":{"observed_at":"2026-05-27T07:38:46.032105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Metalearning continual learning algorithms","venue":null,"work_id":"b5dd08b5-9c21-4bbe-8a74-eba780fd12ce","year":2025},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:750537b09ef3384dfecb497c7d73948ebc4c2644370c27a80fb45f371b386939","observation_id":"0c99f0c7-f6dd-472a-a33a-9263e3e98a3b","resolution":{"observed_at":"2026-05-27T07:38:45.971915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Layer-wise weight decay for deep neural networks","venue":null,"work_id":"cc95d640-6c5c-43da-8279-cffd8539af79","year":2017},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:2145bdaac751e47d070a5ae5afc2a7b00b7868383680aa588ed95130c661f39b","observation_id":"f9001e60-b7d2-485d-874b-f1a6bf2a8a27","resolution":{"observed_at":"2026-05-27T07:38:46.015093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Swifttd: A fast and robust algorithm for temporal difference learning","venue":null,"work_id":"bdf6e815-ca37-43e0-a288-d564f1372720","year":2024},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:9f3121846cc51c3a2d123a279e6488d57274cf81edf975d16f86f2036fb31cb3","observation_id":"dad49520-663d-4b67-938b-0103e787a995","resolution":{"observed_at":"2026-05-27T07:38:46.018343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:079c90623c16fc94b043ca39cc1cf5a8ef3bb69abc41dd74550fc6cb46e2450f","observation_id":"ac6f027b-a32e-49f9-993c-154acd4b08ec","resolution":{"observed_at":"2026-05-12T09:31:26.862999Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Overcoming catastrophic forgetting in neural networks","venue":null,"work_id":"fc0b5f21-1844-4ab7-896a-4757dcfdeaf1","year":2017},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:84854b64549aa8d0234776a93334a6facc1f05565b518dbf618c070e3b158c8c","observation_id":"ba20d61f-87e8-49a0-8a5a-890af36aab26","resolution":{"observed_at":"2026-05-27T07:38:46.035915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A simple weight decay can improve generalization","venue":null,"work_id":"15db0a9b-f7cb-4369-b637-5dfa85e1f2a0","year":1991},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:dc5a7db233e8732c61252658edba3aca37a29e1b3514b621eb3666e4bbe29f25","observation_id":"5a3dc300-ef89-453e-a810-8112f040086f","resolution":{"observed_at":"2026-05-27T07:38:46.021742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Continual learning as computationally constrained reinforcement learning","venue":null,"work_id":"28eccd8e-f1a5-4272-b51f-93e435b15a9b","year":2025},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:a0d8a0ed158f04f57abb85eb73d71dbf126bfc47bfdb8c3e12edd50c3354ce9e","observation_id":"fcf94196-6ff2-495f-a7c5-c0d0d8d138f0","resolution":{"observed_at":"2026-05-27T07:38:46.001794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Maintaining plasticity in continual learning via regenerative regularization","venue":null,"work_id":"172aad4d-767f-48e2-8a07-da66cf347328","year":2025},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:8c7b469c6bbb3c7e51cf382f5c277a5dedaef0ce92624a503a7e68b306ee2561","observation_id":"3791ca0f-2bf8-4f2a-a2a1-8ad28e868459","resolution":{"observed_at":"2026-05-27T07:38:46.047721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c696866d-8eb8-40e6-a69d-b682851e0da8","year":2025},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:39d8b77d84a9299913b6d65cae48602764ded8860a216a4a5fcfef5e2e5fa486","observation_id":"b68e3f62-c710-4c0a-ac3e-162b297eba47","resolution":{"observed_at":"2026-05-27T07:38:45.992002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"30ece2e7-3c79-4ec7-afc1-0cb2a9c0f7d9","year":2019},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:2b0349270bf7ee5754dea081824c47a26fc79909ce3a711469e584a8abe87cdc","observation_id":"68587637-6995-476f-9df4-a8fe297f8ba2","resolution":{"observed_at":"2026-05-27T07:38:45.976550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Meta-gradients in non-stationary environments","venue":null,"work_id":"28196593-88c0-45fc-a505-f9ac0a7ca2aa","year":2022},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:154223334bec71a934ef96950e28b98c055552fdd6f7f98b6fa4ad25e9366777","observation_id":"cf1a4350-83c5-4016-976d-0e1283e0e974","resolution":{"observed_at":"2026-05-27T07:38:45.960030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b04a9349-6f6b-4cd7-825b-1611204b8fda","year":1992},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:342627c5577ead904aa3b357527b38cd88a95b27fb351a7f503df8d98c28a369","observation_id":"7e30fb48-fe0d-47cd-bebf-db40642a79b3","resolution":{"observed_at":"2026-05-27T07:38:45.944285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ecd87546-30a1-4fa0-a2ab-58d8a0de7c9e","year":1992},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:8acbf95907357e6036f3158ef7609690e4c04a7338a2b44319a9af8b43107f5e","observation_id":"04a87fdd-862a-4287-8b3a-7ab477385acf","resolution":{"observed_at":"2026-05-27T07:38:46.008200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Catastrophic interference in connectionist networks: The sequential learning problem","venue":null,"work_id":"f60e1fe0-a13c-4a81-baa6-05baf3df269d","year":1989},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:94f3feb836df7bd07c68ae393d934f5d5f31fb163e3aafde2858db02778929fc","observation_id":"3ce6a942-9b23-43a3-80ba-cb837e8c579e","resolution":{"observed_at":"2026-05-27T07:38:46.043863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"36257679-2e82-4eb5-8cd2-27b04419d54f","year":1989},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:e5661e8a4cd715ec50eec76a956ef5821a4464019f0ff1e3da808036ae69d1a6","observation_id":"6685dd05-2196-46b8-8fb0-0ef46ce336fa","resolution":{"observed_at":"2026-05-27T07:38:46.024847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaptive weight decay for deep neural networks","venue":null,"work_id":"a89412a8-461b-476a-af6f-44f6d24a4768","year":2019},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:14b6d7986862b5d232683ab28b7d3e2d89c80893f9fec3f6c8895492792cc9bd","observation_id":"6ea43c46-8388-460e-a4d6-af1faf6e6674","resolution":{"observed_at":"2026-05-27T07:38:45.985625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The primacy bias in deep reinforcement learning","venue":null,"work_id":"cb173ee6-fda4-427b-a9ec-000ed1fb96e3","year":2022},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:8b4d2734bc1dee6df1a7537bff11b8297032b9142f41c93987444c4dd96c7f33","observation_id":"746fabe3-8f43-4d77-96b8-491b8e659f9b","resolution":{"observed_at":"2026-05-27T07:38:46.078678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Torr, and Puneet K","venue":null,"work_id":"e897025e-cf94-4f0e-9e3f-5c4767f63748","year":2020},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:ee459852d68dda478cc439dc64a40aa31a928566cfe1b3d3cd3f6defde5a4cd0","observation_id":"10e1fb37-2932-4e7a-9140-0ecb1014d657","resolution":{"observed_at":"2026-05-27T07:38:45.998485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Connectionist models of recognition memory: constraints imposed by learning and forgetting functions","venue":null,"work_id":"1370cd1e-6d88-4f70-9a89-af1631b3b616","year":1990},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:d3b9ce4362b5934629fe0c90a26c67f80e9b5898639c50659463b359256f787b","observation_id":"be932b4c-31fc-461f-a063-9d4ab4ed676d","resolution":{"observed_at":"2026-05-27T07:38:46.011808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c4bc6035-f181-4378-b963-648747e010fa","year":1987},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:6a78c7051f59ebedf113833b26ecb92a7047c49498c9ea0d9c61e0743c2b39f6","observation_id":"59c76427-7a86-4ee0-a55c-d250f692eb71","resolution":{"observed_at":"2026-05-27T07:38:46.027897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"u r Informatik, Technische Universit\\","venue":null,"work_id":"a0a9a27f-0392-4e88-8e40-b960595cf81f","year":1987},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:9ff6cab933d4c7f894742116b31439bca48a15d52422a00e3f55c2959145e20c","observation_id":"d3c7c95a-4035-480d-ba8a-6a8b0cdd93de","resolution":{"observed_at":"2026-05-27T07:38:45.929771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Schmidhuber","venue":null,"work_id":"e7fdbf19-d477-402a-8c81-b3b3122d08ec","year":1992},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:2ae027d96a05a848da9480408ebc7714c2a668c33080f211547e7cbd434cae52","observation_id":"3173e0e1-742b-477b-a3e1-aacd02e3c056","resolution":{"observed_at":"2026-05-27T07:38:46.071066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Schmidhuber","venue":null,"work_id":"1fdb8e56-48c8-4e8b-ab19-1b31e8f3e288","year":1993},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:1c1a030d38a56e03e1adc6b2b637360dacdd31a2bd98209e7b754d969ce10c69","observation_id":"b3b587b6-c51f-40e1-b384-95be67e87dfb","resolution":{"observed_at":"2026-05-27T07:38:45.995268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shifting inductive bias with success-story algorithm, adaptive levin search, and incremental self-improvement","venue":null,"work_id":"a8988be1-333c-4a13-abd9-5d5f83c458b2","year":1997},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:3fbcf4aaabdf000c5c5be1d8c6cd280a52e8fe08ab01eaece04e7c30a14eb1b6","observation_id":"53f9cfba-c804-418b-8e60-11c55a67f0af","resolution":{"observed_at":"2026-05-27T07:38:46.005189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Local gain adaptation in stochastic gradient descent","venue":null,"work_id":"6205d38a-827a-4894-b933-4572591eb43e","year":1999},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:9e25b1887a95dc6a59ae0aa4901b85ab9678266f803df38c10d234e30c76b2f6","observation_id":"e83f2054-8fa2-458a-a072-366e6a97f3c6","resolution":{"observed_at":"2026-05-27T07:38:46.062823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Metaoptimize: A framework for optimizing step sizes and other meta-parameters","venue":null,"work_id":"2ef9c9d6-35c8-4feb-bdc0-3cec928aa244","year":2025},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:e220fac1d97f63e3f6f7194998a1c7f5a13bcfb2569afa1b9633b0182f017819","observation_id":"ff47d8e7-cf68-449c-abfd-94b89af88a74","resolution":{"observed_at":"2026-05-27T07:38:45.964131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adapting bias by gradient descent: An incremental version of delta-bar-delta","venue":null,"work_id":"d46fb38d-8877-4938-95d4-fd8609da7792","year":1992},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:9b8ea42ede3cad112355537fa1f1b57801be7d5f2cf6bc223081f50599139aad","observation_id":"b6f407e5-8937-4c7c-8e6a-75d9dba93f63","resolution":{"observed_at":"2026-05-27T07:38:46.039557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.04849","last_updated":"2018-09-13T10:55:56Z","snapshot_observed_at":"2026-07-06T06:33:15.714029Z","submitted_at":"2018-04-13T09:18:17Z","title":"The unreasonable effectiveness of the forget gate","version":3},"cited_work":{"arxiv_id":"1804.04849","doi":null,"metadata_source":"pith","pith_arxiv_id":"1804.04849","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The unreasonable effectiveness of the forget gate","venue":"cs.NE","work_id":"c602c7b5-d501-4f21-a073-f5fab7892bd2","year":2018},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"cited_paper":"/paper/1804.04849","citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:fc6c0c9474b73b52c46252641a94715651ef13f485dfb736806b85eaa4d457c3","observation_id":"89d4c289-f9ed-4fa0-8fee-3d8a3dd30ea1","resolution":{"observed_at":"2026-05-12T09:31:26.851204Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8a2842d1-1885-4b21-8869-91712afed850","year":1960},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:320fc7d5ba280dec48c2f2d42ad75c1a6efb4c260144ac36b6656dec54343470","observation_id":"80da3e50-f688-44fe-901f-cb6950ba8aca","resolution":{"observed_at":"2026-05-27T07:38:45.933343Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A learning algorithm for continually running fully recurrent neural networks","venue":null,"work_id":"983e7357-3e2c-417f-b6c5-73ea4dfa4e0c","year":1989},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:a6bd5f9553cbe36dae45f404cc1d1dbe973cdf5c19829f7e112f892962863f0a","observation_id":"b128c752-9d28-41f1-8dea-af46ab263a74","resolution":{"observed_at":"2026-05-27T07:38:45.948083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the overlooked pitfalls of weight decay and how to mitigate them: A gradient-norm perspective","venue":null,"work_id":"7efc0e40-6b9b-43a0-84cd-525477c3241f","year":2023},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:f74c00eab36af2d997c4934428782e58b8dfcae93833a1219c484adc02ed06a6","observation_id":"35fed7bd-8afc-4047-947a-8f0e7d30e8f7","resolution":{"observed_at":"2026-05-27T07:38:45.952596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Meta-gradient reinforcement learning","venue":null,"work_id":"8ff79494-57c9-467b-a329-6f18a3a14cd1","year":2018},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:935ec265220c67effc62680c8b1c68ac535dc4be4ffe119fbc008fb935753c8c","observation_id":"a77acb58-f246-43d9-aff9-7b07582c61b5","resolution":{"observed_at":"2026-05-27T07:38:46.054959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06464","last_updated":"2025-03-06T06:57:34Z","snapshot_observed_at":"2026-08-03T00:27:18.402796Z","submitted_at":"2024-12-09T13:09:04Z","title":"Gated Delta Networks: Improving Mamba2 with Delta Rule","version":3},"cited_work":{"arxiv_id":"2412.06464","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.06464","snapshot_observed_at":"2026-07-10T21:57:39.161066Z","title":"Gated Delta Networks: Improving Mamba2 with Delta Rule","venue":"cs.CL","work_id":"884939d3-e283-4625-bff4-b7e0e4cc2a6e","year":2024},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"cited_paper":"/paper/2412.06464","citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:13d99722ea0b7d6c1928f5469d6f33b3a4a39e106935197b7d533ae39bdb5083","observation_id":"095cca8c-bc63-4b60-8910-4fc5610cb8d6","resolution":{"observed_at":"2026-05-13T14:50:25.025022Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A self-tuning actor-critic algorithm","venue":null,"work_id":"a41e829f-d606-49f8-b349-935a94ada79e","year":2020},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:4d73620868eb1fe43c3661a76f4076fe2c3e19499f2be3e25fe52fdfcde75d3a","observation_id":"58ef0765-814c-47b3-b547-bc5d89a447d0","resolution":{"observed_at":"2026-05-27T07:38:45.937151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:48.311803Z","title":"write newline","venue":null,"work_id":"8e5fda61-e601-4df4-8204-015bee341570","year":null},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:5fb4451a7d3323e32b574683aa0105c5f69ee4ea249bfbb576412abb8d9db080","observation_id":"ea5eff56-8696-4c3f-afd3-7f17a5bfc3d3","resolution":{"observed_at":"2026-05-27T07:38:46.059305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T23:55:44.012295Z","title":"@esa (Ref","venue":null,"work_id":"b058608d-98d0-4821-a4ae-403d2b7cd411","year":null},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:27835b73a1416c464c6313b8191ebaa75299adfcb53f5c60bb7c4cf8e9c5e3d2","observation_id":"db2949f6-50c2-484f-934a-2e4e28d2d612","resolution":{"observed_at":"2026-05-27T07:38:45.918992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:48.337191Z","title":null,"venue":null,"work_id":"ea79bfb8-d434-45e9-8607-416d3839ec5c","year":null},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:9d4b7a9a29dd6645bec6e6cfabcb3984f217158e36904aa6dfbdc9d3d16b4a67","observation_id":"ff52c3fe-3fee-4d55-9e56-105007c25012","resolution":{"observed_at":"2026-05-27T07:38:45.940938Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d051d6aa-efca-49eb-a66d-8ea01bf21294","year":null},"citing_paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-07T10:36:32.096050Z"},"links":{"citing_paper":"/paper/2604.27063"},"observation_digest":"sha256:698bc08579dce9f1af42e38cc4d0bbdfaa8e7ee74574411650759dc8708ec40e","observation_id":"b6444c0c-b85a-4a6c-933a-59ca0cdd1fb4","resolution":{"observed_at":"2026-05-27T07:38:45.968412Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.27063","last_updated":"2026-04-29T18:01:13Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T18:01:13Z","title":"Learning to Forget: Continual Learning with Adaptive Weight Decay"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":8,"verified_exact":5,"verified_fuzzy":41},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"thesis":"As of 3 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2604.27063."}