{"as_of":"2026-08-08T14:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:492d696dd725d2589b71e56d5c6d31bbb8f9fdc1ffd9d9c0350bb711e066b5b0","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T03:07:54.001891Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T03:14:39.949582Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-01T06:16:24.888925Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"cited_work":{"arxiv_id":"2607.03347","doi":"10.48550/arxiv.2607.03347","metadata_source":"pith","pith_arxiv_id":"2607.03347","snapshot_observed_at":"2026-08-01T06:16:24.888925Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","venue":"cs.LG","work_id":"9b7ec80b-d261-4351-8137-dc467840761e","year":2026},"citing_paper":{"arxiv_id":"2607.25200","last_updated":"2026-07-28T02:13:30Z","snapshot_observed_at":"2026-08-08T10:32:54.823924Z","submitted_at":"2026-07-28T02:13:30Z","title":"Algorithmic Separation between Constant-Depth and Logarithmic-Depth Neural Networks","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T03:14:39.949582Z"},"links":{"cited_paper":"/paper/2607.03347","citing_paper":"/paper/2607.25200"},"observation_digest":"sha256:1fdee19b7886739d47b9ad4115bb97cc3aed6ac137d2d767407be5d2c6cb73d4","observation_id":"1b1e3e37-0966-4b0d-a65c-e758d6955df8","resolution":{"observed_at":"2026-08-01T03:19:17.644733Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.03347/citation-record","integrity":"/paper/2607.03347/integrity","json":"/paper/2607.03347/citation-record.json","paper":"/paper/2607.03347"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"The merged-staircase property: a necessary and nearly sufficient condition for sgd learning of sparse functions on two-layer neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:849f4f903ef443630aeac45e9f9fc3c004904e88b55aebdc0bfae4c0b0013c20","observation_id":"1e189931-d8b0-4636-96cc-3cd3c2c91b3f","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Sgd learning on neural networks: leap complexity and saddle-to-saddle dynamics","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:2ee497568662df7657ee62f501d616e6c3c0e293795d44c2de87f33e2213f29a","observation_id":"0e586882-d6b2-4375-a9cb-a217fe67804c","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08797","last_updated":"2025-10-09T00:43:44Z","snapshot_observed_at":"2026-07-06T15:03:52.079498Z","submitted_at":"2023-03-15T17:43:42Z","title":"Stochastic Interpolants: A Unifying Framework for Flows and Diffusions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08797","snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Stochastic interpolants: A unifying framework for flows and diffusions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"cited_paper":"/paper/2303.08797","citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:340c562f412d96eed1ca18a2c93577fc60c830f5db1e8ddb1bee3e8e48cc8516","observation_id":"7b7f9449-49ca-42fb-bc53-dbcb512f610c","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Algorithmic thresholds for tensor PCA","venue":null,"work_id":null,"year":2052},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:639b7f9edd9f64985f7bb61eec59ce933e5ac42ef2b50fb1e4444e7bb9658dc1","observation_id":"1bd1a306-596c-438b-91de-3937bd310e48","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Online stochastic gradient descent on non-convex losses from high-dimensional inference, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:68c5fcf899d796021950dcd256f3d8bacf0aa991aaf09e5f9b0000c5f86ff0ae","observation_id":"5d03e1b8-7763-4cca-9b8f-93d50653d714","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06401","last_updated":"2024-12-19T09:30:05Z","snapshot_observed_at":"2026-07-06T18:59:47.901397Z","submitted_at":"2024-08-12T12:09:25Z","title":"Langevin dynamics for high-dimensional optimization: the case of multi-spiked tensor PCA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06401","snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"High-dimensional optimization for multi-spiked tensor pca","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"cited_paper":"/paper/2408.06401","citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:13e4bce18a1d560fa2279d4c8a53291a0f521cc98fa9429c99b003de7d9e0f38","observation_id":"17702635-14b3-45c6-8244-65cc42eecf14","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Quality over quantity in attention layers: When adding more heads hurts","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:49dca201b81c717626212aec1ae644d1ac9529fd05854e3fd060f338ae015104","observation_id":"6ddbd7ea-4418-4d34-8867-b7c21b60114f","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"What Can ResNet Learn Efficiently, Going Beyond Kernels? 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:24994f755f14668ba22e2a5bcafac77548002890aeb92f8bee7e3ab38c9a220e","observation_id":"27c9abfe-9802-446f-8f08-1d7542a0e5d8","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Online stochastic gradient descent on non-convex losses from high-dimensional inference","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:79e52dcc43dd4bd1d1001c5a34920f51e686073790144796c40efbc439580592","observation_id":"fe5b2f85-cf19-46e6-b8e4-7e497dac8d1e","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19793","last_updated":"2023-11-02T17:33:13Z","snapshot_observed_at":"2026-08-04T08:51:40.592790Z","submitted_at":"2023-10-30T17:55:28Z","title":"On Learning Gaussian Multi-index Models with Gradient Flow","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19793","snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"On learning gaussian multi-index models with gradient flow","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"cited_paper":"/paper/2310.19793","citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:8756ba680d34737c8b0d19a5bcf8ecf163f8168e5e2d1b0e7fcfbc8eb775d8b4","observation_id":"de88921c-de4e-4e10-bd47-5423f2d41b3d","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Survey on algorithms for multi-index models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:0d0c800f0f3481349d7e241eef2f0c0e0c98b1eefcd037d749cf0bc776414c6c","observation_id":"99d5487b-c554-404b-b6f0-16132bef76c3","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Optimal errors and phase transitions in high-dimensional generalized linear models","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:a107ec84f19938c6b82683a4bc74681ca2a87dba1a92cf7e99388c7d8befd4e6","observation_id":"5c55191c-98fd-4c9d-9a3f-9300099d7e4d","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Invariant scattering convolution networks","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:cd297e7f82b12560eb8cc5cf5bafa41c74da2bf31f6c770b7e197fb93823fb3d","observation_id":"9905aa8e-01fa-4c3f-8532-630dea663ceb","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Resnets of all shapes and sizes: Convergence of training dynamics in the large-scale limit","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:415b4cbd8e04d216e336323e4319daab6a05e88fdb37b413d91ef8dcf26ef8f1","observation_id":"55862490-2eb4-4819-bf2a-5964496201ef","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"The hidden width of deep resnets: Tight error bounds and phase diagrams","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:95ac7b4e1eaff3a132a60cd79368bcd332468a3ddf187f8dbbafea2fc1356ed1","observation_id":"224dbd56-d443-4942-9f16-35eb234a55ad","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04980","last_updated":"2024-06-04T08:28:52Z","snapshot_observed_at":"2026-08-04T04:52:43.129695Z","submitted_at":"2024-02-07T15:57:30Z","title":"Asymptotics of feature learning in two-layer networks after one gradient-step","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04980","snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Asymptotics of feature learning in two-layer networks after one gradient-step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"cited_paper":"/paper/2402.04980","citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:badd84015f756489df61f0facb76cc0512abf2ada7d2f943fa88704a9a1ef63f","observation_id":"3827d155-278d-4b55-830c-408150666751","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"How deep neural networks learn compositional data: The random hierarchy model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:1cd1534a5f1ab88dbb09ce08e86f67a353fb28d770e2c16e54202a4c4ff29980","observation_id":"ba82f010-0f3a-408f-bdb0-ad67b80f2db2","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:8fe67ffbc02b827b2ffaa7c86a18b2a9a55cfa893ee435ed98fb5326220dde91","observation_id":"ddf54aa8-65ce-478c-b050-e941a49a5c6b","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"On the expressive power of deep learning: A tensor analysis","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:7cc777889b333c6ae15891a09e70e93be7775ccf844fdf9c311874f39d240387","observation_id":"dc9142df-5779-4086-9c03-ed23e1d2e25a","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Mse analysis of online sgd for the multiscale single index model","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:7da3c3da482c6b1d7c7ce42c81826c0dffb8f929d89792f78e3e45a65eab45c2","observation_id":"fab2baeb-eb7d-4dab-ab17-2cfdda614289","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Donoho and Michael J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:5cfa312bb5eb9f355fc7a5c3aba044f9f6d6c9a042f7bc316c07ee72cb9e8f07","observation_id":"eb0dd3d1-3ec5-4a26-bc10-b12f855bcfd3","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Learning single-index models in gaussian space","venue":null,"work_id":null,"year":1930},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:5bfe0ac386a0c01363214de4ba7302fa698ba6fa413a586522f4cf69ceb70779","observation_id":"8f2a42aa-4244-4558-ab75-48474a215ab7","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Statistical query lower bounds for tensor pca","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:e3abeb53b96b5392c8e2ba7407e8b77abf6fafb1721fd52dcdddfeb49cb9bff4","observation_id":"db64cf4b-848b-44b4-bdc4-79ed4fc670d3","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18270","last_updated":"2025-06-03T19:12:56Z","snapshot_observed_at":"2026-08-08T04:11:57.213673Z","submitted_at":"2023-05-29T17:43:44Z","title":"How Two-Layer Neural Networks Learn, One (Giant) Step at a Time","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18270","snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Learning two-layer neural networks, one (giant) step at a time","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"cited_paper":"/paper/2305.18270","citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:e4861cf684932fe247ee72f15530543ce2078514a795dc98d0e035a76019dd38","observation_id":"35c1a2cd-d361-4f9c-bc7f-b499cafbcb1c","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05500","last_updated":"2025-06-05T18:34:56Z","snapshot_observed_at":"2026-08-07T16:35:45.153456Z","submitted_at":"2025-06-05T18:34:56Z","title":"The Generative Leap: Sharp Sample Complexity for Efficiently Learning Gaussian Multi-Index Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05500","snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"The generative leap: Sharp sample complexity for efficiently learning gaussian multi-index models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"cited_paper":"/paper/2506.05500","citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:0bfeffdeb12c16b1ed1a476632da798d812fc174ba7856c51fa13c49ccb233c7","observation_id":"11139e03-0d24-46c7-b45c-3d606d79053e","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05529","last_updated":"2024-03-12T22:27:02Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:50:19Z","title":"Computational-Statistical Gaps in Gaussian Single-Index Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05529","snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Computational-statistical gaps in gaussian single-index models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"cited_paper":"/paper/2403.05529","citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:b8246d1484d6dd99526a1460e42e9b77c04fbd4a1ddd1981636ec66434ab3a98","observation_id":"448810d9-aa3a-458d-98d2-59195f5c400d","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"The computational advantage of depth: Learning high-dimensional hierarchical functions with gradient descent, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:bb3e1cbfd82ac2de755ae5ccd751a3eb1d43d9c2cc1bdf1c4b1e4031f5e35e8f","observation_id":"6dad2d0f-388c-4ff1-bc82-e95119aa2c9f","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"The power of depth for feedforward neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:94da3ad2ef0f8d25fef465494aab34ebc1aa72785046b24ceaca34465ea98f56","observation_id":"58028eba-f86d-4ee3-b355-65d7dc52a2e9","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Sharp recovery thresholds of tensor pca spectral algorithms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:c06367ee3e101b2ff8ceb4fb9246968f1c6a90c236c2528b2a18bed72ffb921d","observation_id":"1d4ced3a-1e33-4e99-a49d-3d2be0bf127f","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Universality of high-dimensional scaling limits of stochastic gradient descent","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:7a8e3a1da91dd6f28047a418d5430415721673df918be8327a3ebd329e5c5224","observation_id":"1d2a2009-1b94-4635-a8ca-d695fe74b9e8","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00501","last_updated":"2017-11-03T00:19:35Z","snapshot_observed_at":"2026-07-06T06:07:19.110047Z","submitted_at":"2017-11-01T18:27:42Z","title":"Learning One-hidden-layer Neural Networks with Landscape Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00501","snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Learning one-hidden-layer neural networks with landscape design","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"cited_paper":"/paper/1711.00501","citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:2f2946da361b524a1a6c496ef686a82d24edf9657ef189ae28414f0907a78039","observation_id":"98fcd980-a143-437b-9ac2-4dfd400ae819","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"A mathematical perspective on transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:75f4dce110379980d8a0bf343fdd3e3bfc4edb74704c9464ee00941833a51c6a","observation_id":"df4dfe2e-bd66-4655-ad78-dd0e58f55ed1","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Deep residual learning for image recognition, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:aba5c97ec687da406c0b0cb0a79533cbef919339bc04a18a1b6cf4a6b42d21d1","observation_id":"68cc769c-2eb5-4c8b-b142-5b06b7559858","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05622","last_updated":"2024-07-08T05:30:34Z","snapshot_observed_at":"2026-08-01T15:37:53.369157Z","submitted_at":"2024-07-08T05:30:34Z","title":"On the Complexity of Learning Sparse Functions with Statistical and Gradient Queries","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05622","snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"On the complexity of learning sparse functions with statistical and gradient queries","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"cited_paper":"/paper/2407.05622","citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:3344f7049f4f3e9945f40d85ed27b6390975af4e84c61ef300c48a28555455f4","observation_id":"085a2522-f415-4d3f-a47d-a0ea9f0e7fa8","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.08473","last_updated":"2016-01-12T03:19:42Z","snapshot_observed_at":"2026-07-06T04:22:14.860464Z","submitted_at":"2015-06-28T23:19:49Z","title":"Beating the Perils of Non-Convexity: Guaranteed Training of Neural Networks using Tensor Methods","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.08473","snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Beating the perils of non-convexity: Guaranteed training of neural networks using tensor methods","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"cited_paper":"/paper/1506.08473","citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:ee14aef5fac9fafa4b20cb544d7b39a3e332fca925ffe21f35486bc11dac9137","observation_id":"3750baf9-1072-4e0e-80fe-7b85226a675e","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Bayesian inference with finitely wide neural networks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:05bcc1ed6ad0419e2331a2b4007472deb8fbb248cf9071db9c4d011f5ecc0dc4","observation_id":"7226c86a-18af-4a19-9138-d61bb3b7e84f","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Flow matching for generative modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:10ce02fabc36202d3d6fad188a6958a926776c5e7d5d2795f04e7c97267e84d5","observation_id":"6a23b49c-016b-41b3-b019-fe30f78db91d","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Statistical-computational trade-offs in learning multi-index models via harmonic analysis","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:723a9d34a01ee96b5faa90ec0bfcdadad8152113c79d34d62dfc8d6eaf78a0d5","observation_id":"812e76a9-9bca-4176-b65b-dcb7bbfa0c55","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Understanding deep convolutional networks","venue":null,"work_id":null,"year":2065},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:eaf9053ffdbbc670144067339749815960d025f573b92646e34aa7b609132a86","observation_id":"14f4c00f-5905-4364-806f-ed66dfc54319","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Fundamental limits of weak recovery with applications to phase retrieval","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:292c3a5be8acd941093fcba8a11283ec4277753fe96c20e8f12ad69ddfb69566","observation_id":"fb380fff-48e3-494f-a6b2-0dd8243de6ff","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"A statistical model for tensor pca","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:6e990c660691a066c98c54afe3f29bcedc3dffd221cefcb512805d613b928f9d","observation_id":"4d8c3723-2ebd-4607-80c0-853a98bb94fe","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Phase transitions for feature learning in neural networks, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:4b929c262c389d35e6d9adf56d15dfe7113b52387fe928b79cbf7bfeb2e056bd","observation_id":"549fc86d-1ae8-4492-b080-d9113dbe5c1a","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"The connection between approximation, depth separation and learnability in neural networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:c475db293977a48ac118889b45fba3c56c99f568c7041eed2ceb3ad5acff07da","observation_id":"906e1b47-e2de-49ee-9b9c-d57b1f9bc190","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Provable guarantees for nonlinear feature learning in three-layer neural networks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:18e49ffad0657419056dd5342290b4154f59b3282b7c295bf1cd08ea36a62164","observation_id":"c56481a2-5ab2-4dac-a233-3518139dbb10","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Improving the gaussian approximation in neural networks: Para-gaussians and edgeworth expansions, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:b7cdfa476269241482838c6b773183b5d41fc5eebfe4dc74dab41682214f7e54","observation_id":"a1581c61-c597-47d5-b5db-be3629d09311","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Learning a deep convolutional neural network via tensor decomposition","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:15b494963007dafc61c02de6915802b51857f1407d28dade099696b23518e1bc","observation_id":"0d7985a7-5849-40c5-97d2-41243722091e","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:66d991b584c73ccb8612aba5948d52f835f84c7e3348b268cba60e84e709740b","observation_id":"22a3c2af-3e01-40aa-8d99-955b6e50e368","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"A statistical model for tensor pca","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:53886bc59f28fee321c355374c636ee5ec5bdbe2718261b621374710f3f8390c","observation_id":"ca1b7b57-8134-4007-a496-d282ba4e27cc","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:998d049a1c37b24b8c9935bbfc575f5168ba47bfd34515361eaeeffa20091ff8","observation_id":"bad199ab-f799-469d-932c-aa7efb205fd8","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Optimization-based separations for neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:8dbf7993fe4e06642de5b1185577933cb2e7c51001f59d58963dfedfa9a9dde5","observation_id":"449f39fd-228a-417b-b0ef-23e29dac431c","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Serre, L","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:8715cceb249861de680d791e743b4870b4bdffd775558564647a49a36e6bb70d","observation_id":"ca28737a-436f-42e3-96aa-30954db768f1","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Deep learning of compositional targets with hierarchical spectral methods","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:830444c8757b8bbec59e6564504d459b46fd036f5330bb244ac7ff856e864bc8","observation_id":"2bbddcd2-a7c8-4202-992f-fb7835a00daa","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Benefits of depth in neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:08405946d38da432045aa3e703ffa5b60fc92b0c142c8b49dc35027655475635","observation_id":"0efe9933-7ea8-4b52-889e-b12f06060fa4","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:e4ca68154a2a2bc3997d677c2bdbab345f017b7fe01a77d61a6a5649f9abebb8","observation_id":"7d2d2aad-ec86-46d6-a0d8-7783135c88d3","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:8a6ab2bc5ca7a1110d483811ad0438e27d552c4e8c6360b4d238571f86b9213b","observation_id":"6f7b4851-ce27-4b2b-9316-eb32bff46b7b","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-12T03:07:54.001891Z","title":"Exponential separations in symmetric neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-07-12T03:07:54.001891Z"},"links":{"citing_paper":"/paper/2607.03347"},"observation_digest":"sha256:7b4da3e6dd2d6b038de1abcb8ac5df5de5cacf82ad360ecbbb18f4586dc4aba0","observation_id":"f2d2a4ef-3fbe-469c-af2f-38d49de85b38","resolution":{"observed_at":"2026-07-12T03:07:54.001891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.03347","last_updated":"2026-07-03T14:02:42Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-04T04:21:48.715795Z","submitted_at":"2026-07-03T14:02:42Z","title":"The Multiscale Single-Index Model: A Stylized Model for Hierarchical Feature Learning"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 1 inbound Pith citation observation for arXiv:2607.03347."}