{"as_of":"2026-08-10T20:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b24815a89f384ff0207ddae77462e8f46703a2af46d20d8549543f12e4fc08d","coverage":[{"denominator":98,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":98,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T12:04:05.177853Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T04:06:54.560172Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T23:11:18.064399Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"cited_work":{"arxiv_id":"2502.02496","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.02496","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2502.02496 , year=","venue":null,"work_id":"5a83f18d-2f4f-428e-afbe-768da346f82c","year":null},"citing_paper":{"arxiv_id":"2604.18152","last_updated":"2026-04-20T12:13:23Z","snapshot_observed_at":"2026-08-02T20:06:34.220054Z","submitted_at":"2026-04-20T12:13:23Z","title":"mlr3torch: A Deep Learning Framework in R based on mlr3 and torch","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-10T04:06:54.560172Z"},"links":{"cited_paper":"/paper/2502.02496","citing_paper":"/paper/2604.18152"},"observation_digest":"sha256:013797a977031ce8107c9b0411fde7c13aa25932e203a6323a941b849415c9b2","observation_id":"58a1e8c5-0a1d-46c0-a7bc-5bdea1a778d5","resolution":{"observed_at":"2026-05-11T12:11:05.006758Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"cited_work":{"arxiv_id":"2502.02496","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.02496","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2502.02496 , year=","venue":null,"work_id":"5a83f18d-2f4f-428e-afbe-768da346f82c","year":null},"citing_paper":{"arxiv_id":"2605.03547","last_updated":"2026-05-05T09:18:22Z","snapshot_observed_at":"2026-07-06T23:16:25.301792Z","submitted_at":"2026-05-05T09:18:22Z","title":"Erase Persona, Forget Lore: Benchmarking Multimodal Copyright Unlearning in Large Vision Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-07T17:58:17.879345Z"},"links":{"cited_paper":"/paper/2502.02496","citing_paper":"/paper/2605.03547"},"observation_digest":"sha256:356e44275655d9672fb4ff897d74184d66ef4c2d071937d3394052b447d01176","observation_id":"b250160a-5855-4b0f-88c1-8c500576e7c8","resolution":{"observed_at":"2026-05-11T23:11:18.067261Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.02496/citation-record","integrity":"/paper/2502.02496/integrity","json":"/paper/2502.02496/citation-record.json","paper":"/paper/2502.02496"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.829818Z","title":"Sgd with large step sizes learns sparse features","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.829818Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:bb1c1a4230d79b2b1052d94aecbc88b0f14a187d7bef0bab3107ce34bcf29850","observation_id":"945500ff-1362-4f06-aca1-44b12a32daab","resolution":{"observed_at":"2026-08-09T12:04:04.829818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.834151Z","title":"Implicit regularization in deep matrix factorization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.834151Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:6241b56858e5371d3d438b3c57f794a97ab19215245b1d068d52c6462c234f6e","observation_id":"2f76b7c7-25a7-432c-80af-49943b9fe9ee","resolution":{"observed_at":"2026-08-09T12:04:04.834151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.837607Z","title":"Optimization with sparsity-inducing penalties","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.837607Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:b91732a2be7f1e72cbb303ec3f4c8aeea2a1649e069649e0fbbeca2afacd2544","observation_id":"fc457b09-e138-40f5-8de6-de59a01c1ba2","resolution":{"observed_at":"2026-08-09T12:04:04.837607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.841358Z","title":"Collapsible linear blocks for super-efficient super resolution","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.841358Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:04697d302d630a4c8c55a6c1600a42e10207b6c1a823a278a3835964a5a0aefb","observation_id":"36604650-b7b6-4379-9922-05dcebcf4872","resolution":{"observed_at":"2026-08-09T12:04:04.841358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.844971Z","title":"What is the state of neural network pruning? Proceedings of machine learning and systems, 2: 0 129--146, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.844971Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:dfe966f2150a742cbdbd914736fc4ba62ca40f214f285c9f499bdf409571e57c","observation_id":"742780bb-898b-461b-9a97-e32e5231edf5","resolution":{"observed_at":"2026-08-09T12:04:04.844971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.848655Z","title":"Improving network slimming with nonconvex regularization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.848655Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:e1146ff7aaf34ba1efe46381c4e09f22447fa265a072ca5fe304c41ec7fc3174","observation_id":"40f40167-9148-493f-a2e0-179ec2ca408d","resolution":{"observed_at":"2026-08-09T12:04:04.848655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.852528Z","title":"Stochastic collapse: How gradient noise attracts sgd dynamics towards simpler subnetworks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.852528Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:acb6c15d5acf5dd95e90b34ca9fde8bdd45b38fe867edce358f4a70753417a94","observation_id":"f6a0c5be-bf67-4aa1-a103-2e9d71d34148","resolution":{"observed_at":"2026-08-09T12:04:04.852528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.855824Z","title":"A survey on deep neural network pruning: Taxonomy, comparison, analysis, and recommendations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.855824Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:e7000ad28c2d7888ff6c1753eeb9896020222b3bb73303ebe10fdad8e2ac048f","observation_id":"89f1679d-6ac4-4e58-bf80-0e9620b827f8","resolution":{"observed_at":"2026-08-09T12:04:04.855824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.859106Z","title":"Representation costs of linear neural networks: Analysis and design","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.859106Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:ef3943c9df3dac56fe7f404661c20334bb40c83b8a167fdc28703bb90b37dcba","observation_id":"0fe0637b-9274-4d14-8348-6e3335f506f7","resolution":{"observed_at":"2026-08-09T12:04:04.859106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.03869","last_updated":"2023-01-05T15:44:31Z","snapshot_observed_at":"2026-07-06T10:39:13.102378Z","submitted_at":"2021-02-07T18:06:23Z","title":"Structured Sparsity Inducing Adaptive Optimizers for Deep Learning","version":2},"cited_work":{"arxiv_id":"2102.03869","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.03869","snapshot_observed_at":"2026-08-09T12:04:05.493700Z","title":"Structured Sparsity Inducing Adaptive Optimizers for Deep Learning","venue":"cs.LG","work_id":"2fe72965-5756-4839-b14b-9784d04f667e","year":2021},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.862733Z"},"links":{"cited_paper":"/paper/2102.03869","citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:ad71938e65446f79d7de62c06514401d45fc431aa72bc012e9fb0eceacb99a63","observation_id":"c2c7f986-8665-4cd8-807c-666d9a9ba400","resolution":{"observed_at":"2026-08-09T12:04:05.497834Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.866370Z","title":"Shaving weights with occam's razor: Bayesian sparsification for neural networks using the marginal likelihood","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.866370Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:7cb3d78a60fc29b68395e9c2e93f4387b33ec7257cdb73107335636b5558009b","observation_id":"b947bc29-e265-43b0-8de4-3cbc7ad5e3c1","resolution":{"observed_at":"2026-08-09T12:04:04.866370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.869690Z","title":"Rigging the lottery: Making all tickets winners","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.869690Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:d8c722592beb8ba96f0bf69ba6840f64e4b8f78089d693fd094665c8e32d0597","observation_id":"6ed71f92-c0f2-4021-8d09-3c43f5bf77f3","resolution":{"observed_at":"2026-08-09T12:04:04.869690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.872900Z","title":"Variable selection via nonconcave penalized likelihood and its oracle properties","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.872900Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:f6958685050d846f6ded79f66d88fc2e74e1369301eefb6d6abe1de3fc152708","observation_id":"6fb78ac7-c9c8-4e29-8d80-b4ed19874cf1","resolution":{"observed_at":"2026-08-09T12:04:04.872900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.876080Z","title":null,"venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.876080Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:6102f70c1655733948ccc50d9f5190ec7ebaa6285d9f716e184961d640e9d5e3","observation_id":"6bcd17ff-60c5-4730-a7dd-9e10bc734c35","resolution":{"observed_at":"2026-08-09T12:04:04.876080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.879324Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.879324Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:db081169cd27cf2c232a5c7374af069b2da689a26c996931361a8da0472de5a5","observation_id":"f081fd9d-2d7c-4a32-9fe2-58bc32745dc6","resolution":{"observed_at":"2026-08-09T12:04:04.879324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.882508Z","title":"Pruning neural networks at initialization: Why are we missing the mark? In International Conference on Learning Representations, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.882508Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:f3d8d63e3ad2783ca4c1cd1f26a4265a89031355734f32cc496380b8edcc70ef","observation_id":"ce166b16-73d8-4a02-9f4a-6c026651be63","resolution":{"observed_at":"2026-08-09T12:04:04.882508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.885724Z","title":"Regularization paths for generalized linear models via coordinate descent","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.885724Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:105be9211e4bcdac716af2ceec440a3674dbedb3a8d56cf09051d5aaf29da7ed","observation_id":"46938de7-fda8-44b7-8a31-0d5ced8f7f93","resolution":{"observed_at":"2026-08-09T12:04:04.885724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.09574","last_updated":"2019-02-25T19:18:40Z","snapshot_observed_at":"2026-08-06T16:38:23.884750Z","submitted_at":"2019-02-25T19:18:40Z","title":"The State of Sparsity in Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.09574","snapshot_observed_at":"2026-08-09T12:04:04.889372Z","title":"The state of sparsity in deep neural networks","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.889372Z"},"links":{"cited_paper":"/paper/1902.09574","citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:af754e9c213bd172cbe0e07625ddf934ff58f5c6f7ef00d329eb62918652d895","observation_id":"217ec8cf-c51d-4f92-830b-974e84dbe68c","resolution":{"observed_at":"2026-08-09T12:04:04.889372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.893299Z","title":"The implicit bias of depth: How incremental learning drives generalization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.893299Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:9d040ccb69a78875813b07ecc44d4f459341c87788c7732f872e4a0b35f12c4b","observation_id":"bda5fcfe-204e-4cd7-a903-655655a225bb","resolution":{"observed_at":"2026-08-09T12:04:04.893299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.896485Z","title":"Hypersparse neural networks: Shifting exploration to exploitation through adaptive regularization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.896485Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:2b500cc9f9070286ae3631ff3157548c91ab52725b49afca4ded51fd3a79c208","observation_id":"29e9313a-646a-48c9-8be4-a7683e7e92a3","resolution":{"observed_at":"2026-08-09T12:04:04.896485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.899797Z","title":"Understanding the difficulty of training deep feedforward neural networks","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.899797Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:b0eb756c4a364cdb681c69ee950350001f3566d34e391499d1ceceb94884a2fe","observation_id":"3f94ad43-6ba8-4ace-90af-8985580b0a9a","resolution":{"observed_at":"2026-08-09T12:04:04.899797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:06.168399Z","title":"Least absolute shrinkage is equivalent to quadratic penalization","venue":null,"work_id":"8f8e4e07-dede-44e3-b36f-d4a65053622c","year":1998},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.902933Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:96fd7cad89b4bf045dd613d3e9e7164563d90fa13a15a33f4115bb88e2250c6f","observation_id":"2089e07a-bc88-43ec-b2b5-d1e6f7352999","resolution":{"observed_at":"2026-08-09T12:04:06.174101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:06.152685Z","title":"Implicit bias of gradient descent on linear convolutional networks","venue":null,"work_id":"2c41f437-5d11-4e02-8e05-340cac827bca","year":2018},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.906041Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:d77f1ef9dff16a4e2ab11253cf00cf2d0f004a68ba8e8c992fb253e39a30f6c2","observation_id":"886f1999-70b4-42c1-bad5-97e34e90cc43","resolution":{"observed_at":"2026-08-09T12:04:06.158278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:06.138969Z","title":"Expandnets: Linear over-parameterization to train compact convolutional networks","venue":null,"work_id":"8f481189-c692-4480-ba59-3fd64c671484","year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.909281Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:076843b53a9de0f739ee84efaaba2168936ad5c35e7d5f27d551d73214937187","observation_id":"349a3f93-ff8d-47f9-b264-f9a1eeccd241","resolution":{"observed_at":"2026-08-09T12:04:06.143834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.912391Z","title":"Learning both weights and connections for efficient neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.912391Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:049fc9291c319da49d7347eb0acf8840c9841d7cdc315600e6e771889729471b","observation_id":"04bd836a-09dc-4617-bfa1-acb89b501ed5","resolution":{"observed_at":"2026-08-09T12:04:04.912391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.915596Z","title":"Matrix completion and low-rank svd via fast alternating least squares","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.915596Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:711698ec58e1734f0b47ecdeab3d6fb3f6ee48c1bcdbdc6adcb7a4efa4239cf7","observation_id":"cf50e4e2-7558-4ef0-8f0c-c3f2cb4fee95","resolution":{"observed_at":"2026-08-09T12:04:04.915596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:06.111700Z","title":"Delving deep into rectifiers: Surpassing human-level performance on imagenet classification","venue":null,"work_id":"3a643688-8410-4fab-b5f6-b1eeea15ffa0","year":2015},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.918795Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:3e28b11cc08a45fcc5e105d1c67c6b1dfb4c0581e659aa590a89e01785ae1000","observation_id":"67cc9d49-5cbd-45cd-b28d-6bc654c31634","resolution":{"observed_at":"2026-08-09T12:04:06.116967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.922157Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.922157Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:2d0bf9ef61b2209ab4bae37a99f4777f53a7d6d26f19ba4ae3f4291b7461e9f1","observation_id":"fff2ef47-5954-46e2-84e0-e21a1128ecd6","resolution":{"observed_at":"2026-08-09T12:04:04.922157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:06.095200Z","title":"Structured pruning for deep convolutional neural networks: A survey","venue":null,"work_id":"f172aa55-43d4-49e2-98c7-250ca6107493","year":2023},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.925417Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:78a6c3d7e1eab5a5e45a9737d3dc0ede9d2a521a9d17eb88db86616db73bf861","observation_id":"1f2dc755-3aee-445e-a24e-fbf6c5b295f4","resolution":{"observed_at":"2026-08-09T12:04:06.098790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:06.084049Z","title":"Channel pruning for accelerating very deep neural networks","venue":null,"work_id":"ccce1c23-07b7-4b63-8e73-9583886998a8","year":2017},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.928816Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:aacc3a9781e13adb285c9c110e075accff7ab890f4f951d328518e91cb2aede6","observation_id":"b3320493-65ed-405a-b880-82cd1d39db4a","resolution":{"observed_at":"2026-08-09T12:04:06.088304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:06.073574Z","title":"Sparsity in deep learning: Pruning and growth for efficient inference and training in neural networks","venue":null,"work_id":"bf10437f-e8a9-4d1e-be01-5c8e533ab79e","year":2021},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.932018Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:d91860f7833d235833015b7ef5451bf8f58b8061e30b434cda57e39788c9f699","observation_id":"92ae94d6-8697-4866-968c-e04e10e4d185","resolution":{"observed_at":"2026-08-09T12:04:06.077676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:06.061589Z","title":"Lasso, fractional norm and structured sparse estimation using a hadamard product parametrization","venue":null,"work_id":"4778bd5c-bd9e-430f-8107-55cc423be790","year":2017},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.935487Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:0280794006fce057259a20af9ebcd605bf9e0520959614d77f04069a3d2562ff","observation_id":"ac0ce409-8a19-4a99-b976-7db02647b163","resolution":{"observed_at":"2026-08-09T12:04:06.065423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:06.050106Z","title":"Group sparse optimization via _ p,q regularization","venue":null,"work_id":"fa6f42d0-10ad-41c6-a2e6-7059e46c055a","year":2017},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.939027Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:595ade5e3e2584182bd0690c2455e4a0e3bcc5f05beddde6068975d2a088a938","observation_id":"8bdaaa52-ca05-4769-bf11-ea6c5ebd9d22","resolution":{"observed_at":"2026-08-09T12:04:06.053957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:06.037758Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift","venue":null,"work_id":"742c7788-79fc-4926-b929-f0930bbf65c8","year":2015},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.942965Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:f84a54b80804d7a2954558c91ba841b8fd9dccbe63fbb30b4fbe4840ddf9cf3a","observation_id":"0e241839-75f5-4555-a23f-19fde844bf7c","resolution":{"observed_at":"2026-08-09T12:04:06.042008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:06.026115Z","title":"Implicit bias of large depth networks: a notion of rank for nonlinear functions","venue":null,"work_id":"3139d0eb-e14b-4ac6-b0b6-36ef91193e8f","year":2023},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.946908Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:5a88f8a3f25909637f406bb9add97859b2ee4ea848a1d7a28323f5ea64ce582d","observation_id":"1be7efb9-2174-48b9-a020-6a27ea3ab599","resolution":{"observed_at":"2026-08-09T12:04:06.029888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:06.014640Z","title":"Implicit rank-minimizing autoencoder","venue":null,"work_id":"7b0a17a2-0b5a-4e9c-a602-0a3391747b32","year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.950708Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:4f1583e1a3d58ad4ebbcdd2592ff226c17f45f955b9ac36f218abfcc7959037a","observation_id":"4d111812-6559-4cac-b015-8ad4d32be2e9","resolution":{"observed_at":"2026-08-09T12:04:06.018604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:06.003315Z","title":"Dynamic sparse training: Find efficient sparse network from scratch with trainable masked layers","venue":null,"work_id":"b41bd56d-9ecc-412b-bda2-836c0ca7fb8c","year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.954179Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:13cfb3315ebc71a271cc7a995bbdd5d794af057376cc3c3715378d250fec3f62","observation_id":"e5651d0d-c17d-4578-aa79-26cba12f2318","resolution":{"observed_at":"2026-08-09T12:04:06.007267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03571","last_updated":"2026-04-08T15:22:00Z","snapshot_observed_at":"2026-07-06T15:51:28.002438Z","submitted_at":"2023-07-07T13:06:12Z","title":"Smoothing the Edges: Smooth Optimization for Sparse Regularization using Hadamard Overparametrization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03571","snapshot_observed_at":"2026-08-09T12:04:04.958451Z","title":"u ller, Bernd Bischl, and David R \\","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.958451Z"},"links":{"cited_paper":"/paper/2307.03571","citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:5c65d7a495bf346f4985ce46dcadd633120886683c24e0eee2d55004eaae650b","observation_id":"2b387616-f00a-4479-b996-d7e82d09880e","resolution":{"observed_at":"2026-08-09T12:04:04.958451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.992093Z","title":"Neural mechanics: Symmetry and broken conservation laws in deep learning dynamics","venue":null,"work_id":"93ffc7a4-4dd7-4211-91cc-147cd58c2c0d","year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.962324Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:9639a8a4580b4b21276661c5dc4261bc2872db8ab46889e088f34400a9ed3835","observation_id":"e4dfd844-7d25-4b7f-bec7-a6bbf75561cb","resolution":{"observed_at":"2026-08-09T12:04:05.995785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.979843Z","title":"Soft threshold weight reparameterization for learnable sparsity","venue":null,"work_id":"f19d91c1-c183-40c5-a564-36283c4f2928","year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.966075Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:dff5534bfafea9c67183c682170a9e8ac239d493a43742a30b3d8d3d88f765ae","observation_id":"e3aacfb5-a00b-4711-96b2-e5b5ea5e4ccd","resolution":{"observed_at":"2026-08-09T12:04:05.984243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.969657Z","title":"Training invariances and the low-rank phenomenon: beyond linear networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.969657Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:eb096dc670ceb185c61e3b9fa997b192a428a3fb8529795264a030c1d5fd2e41","observation_id":"e5a19ec9-88b9-485d-9abc-5852a8a87cca","resolution":{"observed_at":"2026-08-09T12:04:04.969657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.973397Z","title":"Optimal brain damage","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.973397Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:3ae7934be0657606361360a4c2ffe041212eb7c5b0eb27b89a8f13cf431a4b73","observation_id":"e4ad0f56-5d0b-4a1b-ab5c-bcec51f591cf","resolution":{"observed_at":"2026-08-09T12:04:04.973397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.977125Z","title":"Gradient-based learning applied to document recognition","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.977125Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:fb53c7b2052d80d7ec8df52647351cfc9f0ae58cd1cbd0fe81600eb6174720e5","observation_id":"5e0119de-5cf4-465b-9440-fa7e07a6c610","resolution":{"observed_at":"2026-08-09T12:04:04.977125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.980574Z","title":"Efficient backprop","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.980574Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:23b223b31d257f5da3d9938dfee447877fd43b0b12d14366d697a2c512263ccf","observation_id":"c6efa03e-49db-42d1-a181-cfb36ea21b1e","resolution":{"observed_at":"2026-08-09T12:04:04.980574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:04.983955Z","title":"Snip: single-shot network pruning based on connection sensitivity","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.983955Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:bbc493428b3f3c063a65c05130d6db812f38af59f172baa9d0e70c64def8ede4","observation_id":"e79b03a6-0d4d-48fa-a6b4-546989c7c320","resolution":{"observed_at":"2026-08-09T12:04:04.983955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.936132Z","title":"Pruning filters for efficient convnets","venue":null,"work_id":"2427d88a-a802-4a7c-9e49-bd1aa4e30264","year":2022},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.987959Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:358da7e9b9ecd7e5a0462a7d6c166ab9a4dafec541ee44f01558f94e52dd7e58","observation_id":"460c5ec0-5a55-497b-883f-79ef3172be5b","resolution":{"observed_at":"2026-08-09T12:04:05.940229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.925507Z","title":"Implicit sparse regularization: The impact of depth and early stopping","venue":null,"work_id":"efec8914-19ad-4e94-b54f-f2c318f85473","year":2021},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.991636Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:a3ba967ae5891db98297ce2f5b45c51a33e7721ea5164d3879b594806ce4d7c6","observation_id":"41bf6454-3f1a-4f64-b6ef-cd313e8143ac","resolution":{"observed_at":"2026-08-09T12:04:05.929094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.914858Z","title":"Improving adaptivity via over-parameterization in sequence models","venue":null,"work_id":"e43cd9a1-5d50-44bc-9bc3-3d59b84db033","year":2024},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.995604Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:33051964c06b1142dbb590580ce528228e2211dd111cd2a83ebb3afbb616fe29","observation_id":"aee53449-0ad8-49d6-8ce7-44f9d045d96c","resolution":{"observed_at":"2026-08-09T12:04:05.918961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.904174Z","title":"Reconciling modern deep learning with traditional optimization analyses: The intrinsic learning rate","venue":null,"work_id":"d3581276-3752-4857-aa3e-b635a478a68c","year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:04.999626Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:350041c3310019714acc6c0b3b6db90562ec84f98d31993c3bdaa2b64100a78d","observation_id":"ea017cbe-d4ec-4973-959e-dad3fd42eef5","resolution":{"observed_at":"2026-08-09T12:04:05.907848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.893759Z","title":"Learning efficient convolutional networks through network slimming","venue":null,"work_id":"c92f5b19-2f86-4501-a355-970ed01b307c","year":2017},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.003599Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:5bbb9af8e31bce2aef49d9e627e556f23ae639726ab641f3449c3de49107dfaf","observation_id":"25640233-295f-4e1c-b30e-24da164fcb2c","resolution":{"observed_at":"2026-08-09T12:04:05.897373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.882185Z","title":"Omnigrok: Grokking beyond algorithmic data","venue":null,"work_id":"90e01907-efe0-40a3-8353-bd9a19c3fee3","year":2023},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.007148Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:2cd1ec9a033701abd8298be6c6066e05908d082375244a1bfebe89f8f9464596","observation_id":"4b86dcb8-518b-45ba-8516-66624028ed3f","resolution":{"observed_at":"2026-08-09T12:04:05.886039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.011342Z","title":"Sgdr: Stochastic gradient descent with warm restarts","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.011342Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:8511c17c3d32e007f9e087bb2a8207ae2d6e917015b53701ea15a6a153d2d5b7","observation_id":"ea8d2a4f-ccd1-446e-804e-c8956a23551a","resolution":{"observed_at":"2026-08-09T12:04:05.011342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.865635Z","title":null,"venue":null,"work_id":"9d04b530-3f91-47cb-9d4c-fb4937d80eaf","year":2018},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.014807Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:99afcce7378ba3a6060270d56d560396a1f0707be119b1bfcd568b549d0b25d2","observation_id":"45b615ae-71f9-4692-9baf-e7612a7d193d","resolution":{"observed_at":"2026-08-09T12:04:05.869206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.018251Z","title":"Spectral regularization algorithms for learning large incomplete matrices","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.018251Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:f88db79160607c839cb0ff9fd827e556eb05f88265751e912e1463d25e070ac3","observation_id":"126dd1a8-b6b8-4512-adb0-635038e6e608","resolution":{"observed_at":"2026-08-09T12:04:05.018251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.021526Z","title":"High-dimensional graphs and variable selection with the lasso","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.021526Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:11cbd67899a2a9b9844011344b2eb37a225591a4c4fd6ec0a520ad25ece21a32","observation_id":"553f237f-76d6-4908-8fc4-1850c904b98b","resolution":{"observed_at":"2026-08-09T12:04:05.021526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.842588Z","title":"Implicit bias of the step size in linear diagonal neural networks","venue":null,"work_id":"4687bb90-3fe2-450e-9f23-5ad8fdfef56e","year":2022},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.024952Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:b2623cf7440f8985dd3561d96393e960ad58b92d87cf3be62c5b50eb08bdd9c0","observation_id":"f948bffc-fbf5-4a87-8d3a-465ed38ecb6d","resolution":{"observed_at":"2026-08-09T12:04:05.846401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.831999Z","title":"In search of the real inductive bias: On the role of implicit regularization in deep learning","venue":null,"work_id":"a88ce84e-7350-4e7d-9bb3-2700f1305e0d","year":2015},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.028442Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:dabd9366834d5c838a9e7414abdef30b2b3279c2b1504603626b3a07f425d805","observation_id":"09fc183d-1831-4c16-abc4-e001de11a79a","resolution":{"observed_at":"2026-08-09T12:04:05.835865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10824","last_updated":"2024-04-22T20:31:04Z","snapshot_observed_at":"2026-08-03T02:29:24.724513Z","submitted_at":"2024-04-16T18:02:15Z","title":"Decoupled Weight Decay for Any $p$ Norm","version":2},"cited_work":{"arxiv_id":"2404.10824","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.10824","snapshot_observed_at":"2026-08-09T12:04:05.458047Z","title":"Decoupled Weight Decay for Any $p$ Norm","venue":"cs.LG","work_id":"dadd0478-b8f1-4c8b-9827-ff160958d971","year":2024},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.032171Z"},"links":{"cited_paper":"/paper/2404.10824","citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:6b1be94e4283ccf0fe59fa1643e858e7122f4a8bcf81ed691b31601a55946160","observation_id":"136e14fa-fc5d-4f6d-bf9d-f5ed0b0df805","resolution":{"observed_at":"2026-08-09T12:04:05.462095Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.820914Z","title":"Kurdyka-- ojasiewicz exponent via hadamard parametrization","venue":null,"work_id":"4f847e5f-d810-4b77-a01a-d53312099ef5","year":2025},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.035885Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:186c1e7e077f6cd6fc26e344cd875259f1bc08a27db2d512647d5f5b2706e30d","observation_id":"aafbba80-6ac6-49f7-81dc-9c2165621b7e","resolution":{"observed_at":"2026-08-09T12:04:05.824860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.808828Z","title":"Deep learning meets sparse regularization: A signal processing perspective","venue":null,"work_id":"26b4b341-8d75-4a78-9247-9f8ab784e72a","year":2023},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.039503Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:3eede4e6fd166e147e19e949ea85376e2803b42cc072cef785eda1c70f1064d3","observation_id":"4443064b-fcc8-49cf-a926-af3f6a866f40","resolution":{"observed_at":"2026-08-09T12:04:05.812794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.796779Z","title":"Implicit bias of sgd for diagonal linear networks: a provable benefit of stochasticity","venue":null,"work_id":"70631a41-ae90-4abd-adb4-fb66dc3abfb3","year":2021},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.043362Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:db4665879c284e2fd615a875133648b1fa2f591b5c8dfb5a8129a3f730ec474d","observation_id":"5307d155-306a-49ab-9f08-a28ca50254ab","resolution":{"observed_at":"2026-08-09T12:04:05.801427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.09838","last_updated":"2018-03-06T14:45:47Z","snapshot_observed_at":"2026-07-06T06:30:19.251357Z","submitted_at":"2018-03-06T14:45:47Z","title":"The exp-normal distribution is infinitely divisible","version":1},"cited_work":{"arxiv_id":"1803.09838","doi":null,"metadata_source":"pith","pith_arxiv_id":"1803.09838","snapshot_observed_at":"2026-08-09T12:04:05.441531Z","title":"The exp-normal distribution is infinitely divisible","venue":"math.PR","work_id":"6713cd5e-f08c-44c8-a4c4-049a75ac00fe","year":2018},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.047012Z"},"links":{"cited_paper":"/paper/1803.09838","citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:aea27351948802e819b474e3231a80f6398c44a294e2264c47146016587fe54e","observation_id":"309ff82c-e912-4c76-bfb3-8b53a5862353","resolution":{"observed_at":"2026-08-09T12:04:05.446144Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.785781Z","title":"Smooth bilevel programming for sparse regularization","venue":null,"work_id":"b9665202-755f-4053-a983-b5e018aac31d","year":2021},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.051032Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:1f0d70b39364d4c53a6625715026c0a4c2be978e9158f692cd6b61cc70c3543c","observation_id":"9972556b-b7cd-4bbd-837f-55bbe5176b6e","resolution":{"observed_at":"2026-08-09T12:04:05.789820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.774963Z","title":"Smooth over-parameterized solvers for non-smooth structured optimization","venue":null,"work_id":"e9480c5f-e291-42ee-b7d8-ac0348ccdbe9","year":2023},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.054605Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:254698530298c62d9b263641fc455bfed353b38913e4a4c946063f0db79a495f","observation_id":"e8fe5e76-ad00-470a-9965-36f26aa9520a","resolution":{"observed_at":"2026-08-09T12:04:05.778650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.02177","last_updated":"2022-01-06T18:43:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-06T18:43:37Z","title":"Grokking: Generalization Beyond Overfitting on Small Algorithmic Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.02177","snapshot_observed_at":"2026-08-09T12:04:05.057837Z","title":"Grokking: Generalization beyond overfitting on small algorithmic datasets","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.057837Z"},"links":{"cited_paper":"/paper/2201.02177","citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:7edb08199103b0f6a0f4d3192ed5aa152a4f091befb5644f83c5535576414d23","observation_id":"bd435dd2-936c-4dd4-b594-fca179c85271","resolution":{"observed_at":"2026-08-09T12:04:05.057837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.764639Z","title":"Winning the lottery with continuous sparsification","venue":null,"work_id":"7f3dcd0d-b82d-4780-b0f6-b8dab93a0995","year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.063725Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:aea6fbc61ea377fbac49a7c780eabbe2b50363a92379b88c3985fb5aece28abb","observation_id":"a9a0a3a8-f806-4a72-aa84-4f5183ffcc3b","resolution":{"observed_at":"2026-08-09T12:04:05.768378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.067450Z","title":"Group sparse regularization for deep neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.067450Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:2adfdbd219b49548df5a993bc06c7dfd5276908b205aba3bbe8bfc69918e3d9f","observation_id":"beeba61a-d4f0-4668-9c72-91c5bd072dfa","resolution":{"observed_at":"2026-08-09T12:04:05.067450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.746314Z","title":"Powerpropagation: A sparsity inducing weight reparameterisation","venue":null,"work_id":"61133fb4-a7d4-4bf7-8238-ceb90c4f0ed4","year":2021},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.071069Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:3b9f8194629f006b23341c3c37e084c20b940a54da295f81c19c24fc02fd91b6","observation_id":"700c5dfb-eec1-4f96-91f8-6ea67fde666f","resolution":{"observed_at":"2026-08-09T12:04:05.750367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.734848Z","title":"A unified scalable equivalent formulation for schatten quasi-norms","venue":null,"work_id":"1d95abb6-8b68-4a10-abca-2af9cc1d5997","year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.074278Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:78711b31579f54124c8d62ce8280f7c2c9120e13a033980de6f1c2c1ceed09c5","observation_id":"b9811267-b1ca-4350-bef8-1531580405a9","resolution":{"observed_at":"2026-08-09T12:04:05.738742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-09T12:04:05.077734Z","title":"Very deep convolutional networks for large-scale image recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.077734Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:6df53ca5a152da3dcbf1e14ec2a857e3c007edf6797ca08234d6d3346d02b59b","observation_id":"b16635a4-1baa-4dfa-bccf-404da5762e1c","resolution":{"observed_at":"2026-08-09T12:04:05.077734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.724364Z","title":"Geometry of the loss landscape in overparameterized neural networks: Symmetries and invariances","venue":null,"work_id":"01053b18-5032-4ff2-b891-149de127259d","year":2021},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.081523Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:a3bc610c4744c2f587c56adb65e5a194a64cf3389c2a1b484d1649207aabe4ec","observation_id":"0da044a0-ad4c-4cba-b14c-e3b23039271e","resolution":{"observed_at":"2026-08-09T12:04:05.727781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.714821Z","title":null,"venue":null,"work_id":"417d981d-6689-4ff7-a701-31b2f0dd4c4e","year":2004},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.084916Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:e09063cf26ce81c6ecdeb88e01ba8cb034d3fb1cd10906fc598b8259b1ca4aa7","observation_id":"ce40cb9a-afb7-4433-9926-c137f1ab3fcf","resolution":{"observed_at":"2026-08-09T12:04:05.718151Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.704776Z","title":"Pruning neural networks without any data by iteratively conserving synaptic flow","venue":null,"work_id":"cb86d6a0-7692-41c7-b34c-ffe5d36ff8b3","year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.088320Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:f12bd1e77541d8b2927c51a133ace596ce886de943762ea1dd5ef13e0bc4ed72","observation_id":"0025309a-58bd-4f88-9d79-a416e9eabc64","resolution":{"observed_at":"2026-08-09T12:04:05.708493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.693724Z","title":"A comprehensive survey on regularization strategies in machine learning","venue":null,"work_id":"26aa26aa-272b-4ead-984b-18a62b5705b2","year":2022},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.091961Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:5301d5731c9c1a0dc3ba99a556b433351441f6d745f9da5be0bea21238830b79","observation_id":"e68645e6-334e-45b4-8a1c-9792d1c23ac2","resolution":{"observed_at":"2026-08-09T12:04:05.697344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.095304Z","title":"Regression shrinkage and selection via the lasso","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.095304Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:96c968f66bcebd6b8bead1ed9f1a8eff2c60733e4ff50e380502ae76ec7bcbd8","observation_id":"919ac0f0-0f44-4ac2-bb06-07c2f83f0dc6","resolution":{"observed_at":"2026-08-09T12:04:05.095304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.677053Z","title":"Equivalences between sparse models and neural networks","venue":null,"work_id":"97b430ae-1ebc-4766-932c-ed2ab1f0fbe2","year":2021},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.098488Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:74e5fe059e9db909400a006ad48a7c762dfa8471f5a971632e074aa209482a1d","observation_id":"28eaf8e3-34cf-48d1-88f3-c4fca7b41caf","resolution":{"observed_at":"2026-08-09T12:04:05.681010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.666007Z","title":"Implicit regularization for optimal sparse recovery","venue":null,"work_id":"ea27edaf-e08c-45c1-9dcc-2bb7091befaa","year":2019},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.101863Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:4920ee4796e9564c3508828815cec9fcc1081df5fc22a85e826d72175771fb41","observation_id":"e34270ba-e0ac-43bf-9f7a-139efa9191c8","resolution":{"observed_at":"2026-08-09T12:04:05.669970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.105178Z","title":"Picking winning tickets before training by preserving gradient flow","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.105178Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:5c45319cf2be4347273b0fa420b9dd715c612436199434a9f2954f5b4ee857b0","observation_id":"111ed457-227b-44fb-abc7-48e2117d3a6e","resolution":{"observed_at":"2026-08-09T12:04:05.105178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05219","last_updated":"2023-02-21T21:36:43Z","snapshot_observed_at":"2026-07-06T14:40:50.270024Z","submitted_at":"2023-01-12T18:58:33Z","title":"Why is the State of Neural Network Pruning so Confusing? On the Fairness, Comparison Setup, and Trainability in Network Pruning","version":2},"cited_work":{"arxiv_id":"2301.05219","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.05219","snapshot_observed_at":"2026-08-09T12:04:05.400973Z","title":"Why is the State of Neural Network Pruning so Confusing? On the Fairness, Comparison Setup, and Trainability in Network Pruning","venue":"cs.CV","work_id":"17bdf4b6-afe4-4397-8aa1-546258729b4d","year":2023},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.108795Z"},"links":{"cited_paper":"/paper/2301.05219","citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:eb3b86ddfd7628b158c718eb6642ee737efabab4fc81a55b0904bd05e6a972bc","observation_id":"967c4304-90e5-4274-a4ed-637c00b25d0d","resolution":{"observed_at":"2026-08-09T12:04:05.407473Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01274","last_updated":"2022-10-05T13:12:28Z","snapshot_observed_at":"2026-08-09T22:58:49.792222Z","submitted_at":"2022-10-03T23:48:48Z","title":"Random Weight Factorization Improves the Training of Continuous Neural Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01274","snapshot_observed_at":"2026-08-09T12:04:05.112761Z","title":"Random weight factorization improves the training of continuous neural representations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.112761Z"},"links":{"cited_paper":"/paper/2210.01274","citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:2a23a6d2ca8dcfa11d95eb91dbb8aa557b53973a5071751abe81281983101eed","observation_id":"ca96eb09-9d47-4891-86c5-5ef5f53d1d52","resolution":{"observed_at":"2026-08-09T12:04:05.112761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.647957Z","title":"Learning structured sparsity in deep neural networks","venue":null,"work_id":"b888a0b9-e218-4aba-b54e-e7b33afe4e9f","year":2016},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.116547Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:a0a64fbdb49d8fabd6a49a95f5d6c3bcc3153db11bbe359ba3ba42b72e5ddffd","observation_id":"aa61edc1-4fbe-4359-a578-2a44c055ec90","resolution":{"observed_at":"2026-08-09T12:04:05.652335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.120352Z","title":"Kernel and rich regimes in overparametrized models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.120352Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:c2e814bfd8aaa1cfa0e3822bf248f901d3461d8ab05f19683fd64c595c4621cf","observation_id":"fc4cf71a-fc03-4869-bbb7-38aa7bd3e965","resolution":{"observed_at":"2026-08-09T12:04:05.120352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.629526Z","title":"L1/2 regularization","venue":null,"work_id":"309c7828-5ae3-41b3-a246-d032435b7624","year":2010},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.123912Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:58a0589207faa4ab7c4167c055700d47617bcb5c6c19299c54f18aab22b5e61b","observation_id":"e8afe785-06a5-4720-b873-13d7f5838641","resolution":{"observed_at":"2026-08-09T12:04:05.633547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.618494Z","title":"Proxsgd: Training structured neural networks under regularization and constraints","venue":null,"work_id":"85fac3e6-5550-4fba-b09b-0a7637c08527","year":2020},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.127451Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:a848fd3d870f053b1e443caeb16b98be0c20f7152fe7bb768500094d29c2c3d8","observation_id":"943ebc3b-ec84-44de-acba-8e34a6a73e76","resolution":{"observed_at":"2026-08-09T12:04:05.622291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.607306Z","title":"92.45\\ https://torch.ch/blog/2015/07/30/cifar.html, 2015","venue":null,"work_id":"c6f212d6-8158-49bc-8601-a08cffe81b75","year":2015},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.130876Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:a5340b96ecddf15719ddbb4dcb94d49d9a11f99c5a8b28ae8ae1cc5c75156942","observation_id":"8558e657-d7dc-4818-b4f4-d34cdbb39ccf","resolution":{"observed_at":"2026-08-09T12:04:05.611306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.134231Z","title":"Wide residual networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.134231Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:56aae7685f187044aaa7a5f4b4e3f8c5084bded57478a09f8353dcd0de666393","observation_id":"b774b5df-b27b-4713-b984-7af8d58ad069","resolution":{"observed_at":"2026-08-09T12:04:05.134231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.137733Z","title":"Nearly unbiased variable selection under minimax concave penalty","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.137733Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:52f698c25725c0307bb3f89cac86ebbde6ead3371c619a485eebda62f18462f3","observation_id":"b362e031-e64c-4978-826e-864628dd5a4c","resolution":{"observed_at":"2026-08-09T12:04:05.137733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.581168Z","title":"The sparsity and bias of the lasso selection in high-dimensional linear regression","venue":null,"work_id":"bca15b3a-a422-45b3-b90e-c67f655fe6fe","year":2008},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.141253Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:636c3841b8e5529cf483c9a8b8db00a803c82ec892dc57b4251af273a284f4de","observation_id":"f3516908-d452-4913-8c73-a14de7f67101","resolution":{"observed_at":"2026-08-09T12:04:05.586155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.569136Z","title":"How sparse can we prune a deep network: A fundamental limit perspective","venue":null,"work_id":"6ea1b279-09c6-4849-8ba4-c841d27ec463","year":2024},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.144513Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:088c0b377c63ea7bfb8dafbb3b9c09d553cb055161845b23adef2392cfc2f1b7","observation_id":"4aa5c346-c683-41a5-a931-3ffd85f595d6","resolution":{"observed_at":"2026-08-09T12:04:05.573187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.558265Z","title":"High-dimensional linear regression via implicit regularization","venue":null,"work_id":"9bdb4ce9-31c1-443f-91f0-d1ecf367f182","year":2022},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.147859Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:88a9e1316a2f9bf53ad6500b60b25f8a4a2d22268e7320f64ae9b6d949f6d872","observation_id":"b811e75a-6bae-4798-b202-d873ab74269f","resolution":{"observed_at":"2026-08-09T12:04:05.562118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.547125Z","title":"Effective sparsification of neural networks with global sparsity constraint","venue":null,"work_id":"24f46af4-432d-4fee-940b-31f6da5ea205","year":2021},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.151338Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:30ef1639a64b5a78ca94edfd04cc11cee0d77f5aafe583c27b1321cffef2f27d","observation_id":"665e1cf3-8c11-4a05-a0c3-11e99a11372c","resolution":{"observed_at":"2026-08-09T12:04:05.551158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.535375Z","title":"Symmetry induces structure and constraint of learning","venue":null,"work_id":"a2b4ccc6-2274-4fd7-ad75-06dc4a55b67e","year":2023},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.154497Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:9c73bd2591c2099c06c09c609a44b0834cca508b9cc80b262607d77479409f64","observation_id":"d34e6172-be2b-416a-bdf1-de894fbb14a4","resolution":{"observed_at":"2026-08-09T12:04:05.539229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.524306Z","title":"spred: Solving l1 penalty with sgd","venue":null,"work_id":"22377440-5bec-46a5-8bb6-74c0ca47b7e7","year":2023},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.158128Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:87e24311172ee0ef3c3a538226b8123b0ccd2ef3c485ea151f9207ab8f44f97d","observation_id":"6470c0f4-13b4-4536-8257-8e413336c392","resolution":{"observed_at":"2026-08-09T12:04:05.528020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13093","last_updated":"2024-07-02T13:05:59Z","snapshot_observed_at":"2026-08-09T22:38:13.649380Z","submitted_at":"2023-03-23T08:17:10Z","title":"Type-II Saddles and Probabilistic Stability of Stochastic Gradient Descent","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13093","snapshot_observed_at":"2026-08-09T12:04:05.161574Z","title":"The probabilistic stability of stochastic gradient descent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.161574Z"},"links":{"cited_paper":"/paper/2303.13093","citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:91d73e583289f5067ab727c8fe5480c6e9aa0f0507a4d6f91cdcbb497e61aa17","observation_id":"20fef001-8622-46aa-9d73-ef0ad1fe1927","resolution":{"observed_at":"2026-08-09T12:04:05.161574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.165596Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.165596Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:1df3fd7f30794dc5045c4c6f88f779d33fe9ac5894dc2d71a596134bd58b4c74","observation_id":"e9fadd08-deef-48aa-b347-612b8773ef82","resolution":{"observed_at":"2026-08-09T12:04:05.165596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.170153Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.170153Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:ac355c9b40b2c2b645700945d6054d1dd69c046ccf8486fcaeab741aac8ba0ce","observation_id":"66533bae-adcf-4fd5-ab1c-66eeb4bf1b86","resolution":{"observed_at":"2026-08-09T12:04:05.170153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.174042Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.174042Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:23e2ad6f1cf60fa0b6330035d52cdd3ae8df87576a8ecfbd4f19e1fb4bf2bd4c","observation_id":"60b7f51d-75a5-4ffd-979d-d18d7bc04051","resolution":{"observed_at":"2026-08-09T12:04:05.174042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:04:05.177853Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries","version":2},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-09T12:04:05.177853Z"},"links":{"citing_paper":"/paper/2502.02496"},"observation_digest":"sha256:af8db98616a087813d076ca8377a45b3a3381ef51d5e4925b0f3d18149248865","observation_id":"6b298491-a2b6-45d2-8326-20c60dccf530","resolution":{"observed_at":"2026-08-09T12:04:05.177853Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.02496","last_updated":"2025-02-07T11:53:07Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T08:01:55.326746Z","submitted_at":"2025-02-04T17:12:56Z","title":"Deep Weight Factorization: Sparse Learning Through the Lens of Artificial Symmetries"},"reference_resolution":{"displayed":98,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":4,"verified_fuzzy":46},"total_outbound_references":98},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 98 of 98 outbound references and 2 inbound Pith citation observations for arXiv:2502.02496."}