{"as_of":"2026-08-08T19:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3d7d64a24e902eb94510b1d92ddd15cb2ed878e0be7eb856dcc16019461e4b91","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:35:49.377235Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T20:55:03.949611Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"cited_work":{"arxiv_id":"2507.02550","doi":"10.48550/arxiv.2507.02550","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02550","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and D'Ascenzo, Davide and Dubach, Rafael and Poggio, Tomaso , year = 2025, month = jul, number =","venue":"DSpace@MIT (Massachusetts Institute of Technology)","work_id":"718c7264-385c-4cd0-ab0a-8486f30b9540","year":2026},"citing_paper":{"arxiv_id":"2605.08934","last_updated":"2026-06-16T20:17:16Z","snapshot_observed_at":"2026-07-06T23:21:06.773761Z","submitted_at":"2026-05-09T13:08:07Z","title":"From Mechanistic to Compositional Interpretability","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-12T02:42:26.173782Z"},"links":{"cited_paper":"/paper/2507.02550","citing_paper":"/paper/2605.08934"},"observation_digest":"sha256:47d283366554b50315994ad6f1dda70ab3967c9c876a783914474ffa237c925f","observation_id":"874bfd00-bb95-45fc-8c44-9e0058a67dff","resolution":{"observed_at":"2026-05-12T02:46:18.513779Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"cited_work":{"arxiv_id":"2507.02550","doi":"10.48550/arxiv.2507.02550","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02550","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and D'Ascenzo, Davide and Dubach, Rafael and Poggio, Tomaso , year = 2025, month = jul, number =","venue":"DSpace@MIT (Massachusetts Institute of Technology)","work_id":"718c7264-385c-4cd0-ab0a-8486f30b9540","year":2026},"citing_paper":{"arxiv_id":"2605.14764","last_updated":"2026-05-14T12:26:50Z","snapshot_observed_at":"2026-08-02T09:09:19.474755Z","submitted_at":"2026-05-14T12:26:50Z","title":"Compositional Sparsity as an Inductive Bias for Neural Architecture Design","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T20:55:03.949611Z"},"links":{"cited_paper":"/paper/2507.02550","citing_paper":"/paper/2605.14764"},"observation_digest":"sha256:a4d4910d78abb334b6535f621e9254ed764ee99abb5f8f556b3f2a2a312c5561","observation_id":"9c70c116-e10a-4ea2-b64e-b0bf3286452f","resolution":{"observed_at":"2026-07-01T14:35:46.881494Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"cited_work":{"arxiv_id":"2507.02550","doi":"10.48550/arxiv.2507.02550","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02550","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and D'Ascenzo, Davide and Dubach, Rafael and Poggio, Tomaso , year = 2025, month = jul, number =","venue":"DSpace@MIT (Massachusetts Institute of Technology)","work_id":"718c7264-385c-4cd0-ab0a-8486f30b9540","year":2026},"citing_paper":{"arxiv_id":"2605.25608","last_updated":"2026-05-25T09:02:13Z","snapshot_observed_at":"2026-08-06T13:35:50.904852Z","submitted_at":"2026-05-25T09:02:13Z","title":"Learning Sparse Compositional Functions with Norm-Constrained Neural Networks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T20:33:03.854188Z"},"links":{"cited_paper":"/paper/2507.02550","citing_paper":"/paper/2605.25608"},"observation_digest":"sha256:fef02c5f46e276bc52529e6bb8a09d6895228918bace688d0b1c32f2a4bad708","observation_id":"2cb45454-5812-42e6-b4ba-d9335a0d6b1e","resolution":{"observed_at":"2026-06-29T20:33:58.324454Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"cited_work":{"arxiv_id":"2507.02550","doi":"10.48550/arxiv.2507.02550","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02550","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and D'Ascenzo, Davide and Dubach, Rafael and Poggio, Tomaso , year = 2025, month = jul, number =","venue":"DSpace@MIT (Massachusetts Institute of Technology)","work_id":"718c7264-385c-4cd0-ab0a-8486f30b9540","year":2026},"citing_paper":{"arxiv_id":"2606.19941","last_updated":"2026-06-18T08:39:07Z","snapshot_observed_at":"2026-08-03T00:29:25.767611Z","submitted_at":"2026-06-18T08:39:07Z","title":"Compositionality Emerges in a Narrow Depth-Connectivity Regime: Architecture Constraints and Solution Manifolds","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T18:22:56.676469Z"},"links":{"cited_paper":"/paper/2507.02550","citing_paper":"/paper/2606.19941"},"observation_digest":"sha256:5d9e53c3b38664b88bb72e44ba376d05c1c82911fe79897426ca0cc0aa8f54e9","observation_id":"954a043a-8377-4f1d-ba2a-c1fdece242eb","resolution":{"observed_at":"2026-07-04T03:09:29.761198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"cited_work":{"arxiv_id":"2507.02550","doi":"10.48550/arxiv.2507.02550","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02550","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and D'Ascenzo, Davide and Dubach, Rafael and Poggio, Tomaso , year = 2025, month = jul, number =","venue":"DSpace@MIT (Massachusetts Institute of Technology)","work_id":"718c7264-385c-4cd0-ab0a-8486f30b9540","year":2026},"citing_paper":{"arxiv_id":"2606.26705","last_updated":"2026-06-25T07:34:20Z","snapshot_observed_at":"2026-08-06T04:49:54.659745Z","submitted_at":"2026-06-25T07:34:20Z","title":"Algorithmic Foundations of Deep Learning: Complexity-Theoretic Rates and a Characterization of Universal Approximation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T05:19:56.528337Z"},"links":{"cited_paper":"/paper/2507.02550","citing_paper":"/paper/2606.26705"},"observation_digest":"sha256:f4dd2f4109cc985897b84ecfe6da5ed2cb3468a7bb682a34fa44353d94de2741","observation_id":"f3510f5b-4d76-4733-bbdc-0ec6a85ce116","resolution":{"observed_at":"2026-07-04T13:19:50.617560Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.02550/citation-record","integrity":"/paper/2507.02550/integrity","json":"/paper/2507.02550/citation-record.json","paper":"/paper/2507.02550"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2108.10573","last_updated":"2021-11-24T02:03:49Z","snapshot_observed_at":"2026-07-06T11:41:00.577404Z","submitted_at":"2021-08-24T08:19:05Z","title":"The staircase property: How hierarchical structure can guide deep learning","version":2},"cited_work":{"arxiv_id":"2108.10573","doi":null,"metadata_source":"pith","pith_arxiv_id":"2108.10573","snapshot_observed_at":"2026-08-06T20:35:50.453090Z","title":"The staircase property: How hierarchical structure can guide deep learning","venue":"cs.LG","work_id":"7b29fcb8-50e7-44ff-9cc8-8c02f7ccf8ed","year":2021},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:42.772274Z"},"links":{"cited_paper":"/paper/2108.10573","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:02b40c3f2a0c9acf75996d594f611ee692cd3f943c5c53e8fdc012ed775435df","observation_id":"e99bff07-a10d-4722-afad-72238bc9266d","resolution":{"observed_at":"2026-08-06T20:35:50.551112Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:00.509052Z","title":"B., and Misiakiewicz, T","venue":null,"work_id":"92c406d4-1d5d-47b1-9ea8-7d038924a383","year":2022},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:42.811795Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:6660ee60f95c649d7368152afdcfd8f8fc3df7faac384041a13b13f03171c9c2","observation_id":"7cdaa196-698b-4399-ac44-1105d89ca93a","resolution":{"observed_at":"2026-08-06T20:36:00.569728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.11055","last_updated":"2023-08-31T21:09:03Z","snapshot_observed_at":"2026-07-06T14:54:22.655445Z","submitted_at":"2023-02-21T23:16:23Z","title":"SGD learning on neural networks: leap complexity and saddle-to-saddle dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.11055","snapshot_observed_at":"2026-08-06T20:35:42.849130Z","title":"Sgd learning on neural networks: leap complexity and saddle-to-saddle dynamics","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:42.849130Z"},"links":{"cited_paper":"/paper/2302.11055","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:382ca8cbfd13caa44cad4260c84921e7eb4a9d3dc0a13b48a42a0ac73d4acf97","observation_id":"eb208633-a54a-4dbe-b5a0-c6fa7cffcaa3","resolution":{"observed_at":"2026-08-06T20:35:42.849130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:42.930526Z","title":"J., Bambrick, J., Bodenstein, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:42.930526Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:65823fd754b13e0b06870ec2d5cefbdc7c3b2b9ec8b698c4517e91328bb52b13","observation_id":"9ad3c338-a46f-4795-9beb-51881d6f4d6c","resolution":{"observed_at":"2026-08-06T20:35:42.930526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:00.335840Z","title":"Online Learning and Information Exponents : On The Importance of Batch size, and Time / Complexity Tradeoffs , June 2024 a","venue":null,"work_id":"95f84ece-dc93-41d5-b0b3-1ff3838ecd67","year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:42.998566Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:289d52cb9652376595163d6399a559bae3954a142a36831aa5210786cf30b78b","observation_id":"d443a002-135f-450f-b756-feeb276c8daf","resolution":{"observed_at":"2026-08-06T20:36:00.434860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:36:00.140061Z","title":"Repetita Iuvant : Data Repetition Allows SGD to Learn High-Dimensional Multi-Index Functions , May 2024 b","venue":null,"work_id":"d40f0250-801e-4855-bfa7-8a09583e1eb6","year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.110115Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:4496dc1777debbbd0014846e977df41910da2ac1abe1a812dece8b9da0e39f94","observation_id":"d85e8884-f347-47ae-8b55-5a70f7769c9c","resolution":{"observed_at":"2026-08-06T20:36:00.230962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:59.934736Z","title":"and Barak, B","venue":null,"work_id":"e84ff43e-0906-4bdf-b0fe-c359255a1884","year":2009},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.214120Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:64f10071ef7c087f58f2c5e8d81695321fec640e2c6f85ca5a403c467094ee7c","observation_id":"308e7920-98cb-48e9-8858-01dfa2cc7915","resolution":{"observed_at":"2026-08-06T20:36:00.037713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:59.721045Z","title":"B., Gheissari, R., and Jagannath, A","venue":null,"work_id":"8bc6c6c1-eb18-44ca-afe9-5918fda28f33","year":2021},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.290256Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:dc67551c5c5136ae8195d017bc53c499094d227f184c5691ac2e38af7abf920a","observation_id":"19fb3b33-3e57-4038-9fd7-f952535e9bf6","resolution":{"observed_at":"2026-08-06T20:35:59.827444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:59.538654Z","title":"and Kohler, M","venue":null,"work_id":"aed2c413-11eb-461d-8887-fdd21e6ad82f","year":2019},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.381225Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:c5e431f2a60c24c4108179b164c26307de34cced80f2bd83ee6cb3cdefd75f60","observation_id":"442507d7-44e7-43b5-b40a-095677094893","resolution":{"observed_at":"2026-08-06T20:35:59.600703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14711","last_updated":"2023-09-18T17:50:21Z","snapshot_observed_at":"2026-08-05T09:44:53.569339Z","submitted_at":"2023-08-28T17:11:41Z","title":"Fast Feedforward Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14711","snapshot_observed_at":"2026-08-06T20:35:43.474963Z","title":"and Wattenhofer, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.474963Z"},"links":{"cited_paper":"/paper/2308.14711","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:711766ae30121089895ebf62e4be357f7f465b0681b4994b4d7e1f866d71c581","observation_id":"6075bcdb-7196-458f-a53a-448fb0cb73ea","resolution":{"observed_at":"2026-08-06T20:35:43.474963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:59.372783Z","title":"Deep neural network approximation theory for high-dimensional functions, 2021","venue":null,"work_id":"3c54355d-36a7-4cef-ae20-d1e1f6aeb0a4","year":2021},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.568166Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:f1bd9dbf233ac76635fd1a9054da70e854a9001ef31e67e8a4387cddf8a9696d","observation_id":"20c6c8cd-1cd4-4e03-9c35-18764ac29c6c","resolution":{"observed_at":"2026-08-06T20:35:59.440412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11110","last_updated":"2024-06-17T00:19:16Z","snapshot_observed_at":"2026-07-06T18:31:53.591578Z","submitted_at":"2024-06-17T00:19:16Z","title":"How Neural Networks Learn the Support is an Implicit Regularization Effect of SGD","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11110","snapshot_observed_at":"2026-08-06T20:35:43.680310Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.680310Z"},"links":{"cited_paper":"/paper/2406.11110","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:3d760f9e8784ce70e2dd14372b8311b06c2808b9730dc2af7bc05fc72bc5ce11","observation_id":"fa3d9f13-c2d7-4737-8c8a-4e26292769cf","resolution":{"observed_at":"2026-08-06T20:35:43.680310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:59.161936Z","title":null,"venue":null,"work_id":"91d07b3c-7633-4068-bcc3-2ab0e5694e6d","year":1981},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.747835Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:a8dc13fc2c48103cca7892ba350bd51ecf2d7aaff49f2a4d204f4fdab7400cf1","observation_id":"527a08e8-4fb0-4857-abc9-e61bed1fe3a6","resolution":{"observed_at":"2026-08-06T20:35:59.268398Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:58.967259Z","title":null,"venue":null,"work_id":"95fefc8b-44d5-4698-90c6-837217d839ed","year":1964},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.876835Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:b06ffe7c2ee8cb342d7e06af6b2383c76a7e642a422c79aa6d8228473c422231","observation_id":"ca3b217e-5beb-4706-ad45-2aeb9f303f1c","resolution":{"observed_at":"2026-08-06T20:35:59.047724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:58.789793Z","title":"and Gerstner, W","venue":null,"work_id":"eb057096-5407-43d3-91d5-bd2c0da00632","year":2019},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:43.953307Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:90ccca66ae88182417e3b939b81358280ea9639de0c2b1101b83ebfaf55c96fe","observation_id":"1f699ffb-c3e5-48de-9a26-abf4dd73a5dc","resolution":{"observed_at":"2026-08-06T20:35:58.875851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:58.562056Z","title":null,"venue":null,"work_id":"d6719e9b-fd38-4ed4-a68f-3976c2081f89","year":1901},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.062372Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:800498f9e5900c24d834fb778f4c29ca78385a6321319464bce63c711f9c3dc3","observation_id":"e74d1236-8fb1-4f9a-866d-2c87da0d6f64","resolution":{"observed_at":"2026-08-06T20:35:58.664776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:58.413344Z","title":"and Hsu, D","venue":null,"work_id":"4356e105-06ce-4738-9ad1-e3650a3d8099","year":2025},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.167655Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:baf56e1e7622595ad58a384a9088982994e9c07b6c3740286e5d9351a905216d","observation_id":"e3caacd7-685c-4619-b310-622b5a651e38","resolution":{"observed_at":"2026-08-06T20:35:58.501369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:58.210647Z","title":"A., Horvitz, E., Kamar, E., Lee, P., Lee, Y","venue":null,"work_id":"c34ed844-32be-4efa-aff3-8cf57608c82c","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.213489Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:0172834649d23a5526c0e151d92ca1c363067bb4086a86d33e55affebcb3e040","observation_id":"5c0484e8-b78f-4807-8ae3-4b94923981fa","resolution":{"observed_at":"2026-08-06T20:35:58.321955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:44.279950Z","title":"M., Favero, A., and Wyart, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.279950Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:735ea36c20904fd986418a186418285251013c50f7ddce8ccb6822ef04202759","observation_id":"a1d838dc-cd89-4974-bbdb-d09f874ec05e","resolution":{"observed_at":"2026-08-06T20:35:44.279950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:58.006211Z","title":"Superposition of many models into one","venue":null,"work_id":"7596d57f-97c1-4a7e-ab1f-0e04ff72169c","year":2019},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.320140Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:6816a6c4b7c14703ea1a6d17e0bfa229daff920e42f3fa2dc210f2b958990bbd","observation_id":"fa97e1fe-a96d-4c91-941e-f750ba9f1585","resolution":{"observed_at":"2026-08-06T20:35:58.099368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:57.835502Z","title":"M., Khosla, A., Pantazis, D., Torralba, A., and Oliva, A","venue":null,"work_id":"2c3f5ee1-0614-4772-98a0-4bcffdea81f7","year":2016},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.388911Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:8c0cb6e75d933232ae78bbcb80010c3d873a7b67999bd44ddc48528118c951dc","observation_id":"eb0dff58-42b0-4c61-86d7-3713a72e2ea0","resolution":{"observed_at":"2026-08-06T20:35:57.940980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.06128","last_updated":"2023-06-14T14:55:15Z","snapshot_observed_at":"2026-08-07T11:50:26.855529Z","submitted_at":"2022-07-13T11:25:19Z","title":"Compositional Sparsity, Approximation Classes, and Parametric Transport Equations","version":2},"cited_work":{"arxiv_id":"2207.06128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.06128","snapshot_observed_at":"2026-08-06T20:35:50.209534Z","title":"Compositional Sparsity, Approximation Classes, and Parametric Transport Equations","venue":"math.NA","work_id":"7f48d6e8-1ac8-4978-b011-face917ec1bf","year":2022},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.452664Z"},"links":{"cited_paper":"/paper/2207.06128","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:2d502398d942d2ec9890420e637ffd286853f047570f53e78b7ea2cf2d423479","observation_id":"b6f41265-6ec9-4dc5-b182-8dc7bd82f80e","resolution":{"observed_at":"2026-08-06T20:35:50.304551Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:57.667019Z","title":"F., Gou, Z., Shao, Z., Li, Z., Gao, Z., Liu, A., ..., and Zhang, Z","venue":null,"work_id":"e7340ce7-e383-486a-9dbf-7c8ebf93d114","year":2025},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.512157Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:9df492372b615c2e7d092936af0f4d20714c86247a1f93af46e766d832c619b4","observation_id":"5f63bab7-3ba4-4d82-abae-f1f0c3a7d6e6","resolution":{"observed_at":"2026-08-06T20:35:57.746079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:57.499700Z","title":"Seeing it all: Convolutional network layers map the function of the human visual system","venue":null,"work_id":"b89348c2-cda0-4d9e-bcf9-75f54dd5a39c","year":2017},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.615708Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:82f47a590ae0ab92932ae06d201419735411db3bcd2709eab31fc471c4453172","observation_id":"9c6ee06e-a500-4d24-a9a9-25573103d067","resolution":{"observed_at":"2026-08-06T20:35:57.565716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19150","last_updated":"2024-09-27T21:25:00Z","snapshot_observed_at":"2026-07-06T19:23:42.238273Z","submitted_at":"2024-09-27T21:25:00Z","title":"On the Power of Decision Trees in Auto-Regressive Language Modeling","version":1},"cited_work":{"arxiv_id":"2409.19150","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.19150","snapshot_observed_at":"2026-08-06T20:35:49.967485Z","title":"On the Power of Decision Trees in Auto-Regressive Language Modeling","venue":"cs.CL","work_id":"bcec7195-b335-4410-aca6-df1fe7a32941","year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.689412Z"},"links":{"cited_paper":"/paper/2409.19150","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:070d9ff21933d47242ff0f2c7cc64f01977dd57736ab15f1f281dc3be51a5ed3","observation_id":"a21c5af1-c143-46b1-9914-28cfb916c835","resolution":{"observed_at":"2026-08-06T20:35:50.075447Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.12051","last_updated":"2019-12-28T10:44:16Z","snapshot_observed_at":"2026-07-06T08:24:47.835194Z","submitted_at":"2019-09-26T12:38:41Z","title":"The Implicit Bias of Depth: How Incremental Learning Drives Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.12051","snapshot_observed_at":"2026-08-06T20:35:44.758347Z","title":"The implicit bias of depth: How incremental learning drives generalization","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.758347Z"},"links":{"cited_paper":"/paper/1909.12051","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:7045c885835d75f03eeec9aa6995f2b41ccad2042b3d1649752f7c6e01f80f9b","observation_id":"8b518776-ef2f-4a79-b39f-86d15618409f","resolution":{"observed_at":"2026-08-06T20:35:44.758347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:44.802137Z","title":"How to construct random functions","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.802137Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:4577b2fab841677a8f5dd9c21c6119bba5d867fb5be9b93ad9ea083477e30a26","observation_id":"af59e188-861f-4fa5-98bf-0dd5f415b7f5","resolution":{"observed_at":"2026-08-06T20:35:44.802137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:57.302334Z","title":"In-context learning of large language models explained as kernel regression","venue":null,"work_id":"d87c510a-c6ab-4e74-8097-5bbe6a365385","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.867356Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:f90558f6dfd8b03d821e7cf4dc28b7e497b0122d941a25de9499fd8f69a954cc","observation_id":"76c74de4-5054-4fa1-9cb9-992d5ce82a8f","resolution":{"observed_at":"2026-08-06T20:35:57.384097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:57.111768Z","title":"The Elements of Statistical Learning","venue":null,"work_id":"5e38ba4f-7583-4bc4-bac4-b4a9b056a39b","year":2009},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.911215Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:a396c1f042c8efb715b9d84e03d58d6b131f77bb1a1eb5e7edca46b129c6f9ab","observation_id":"2cc0ea4a-dc28-4eac-9237-890b1b95e389","resolution":{"observed_at":"2026-08-06T20:35:57.188360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:56.918576Z","title":"A., and Lenat, D","venue":null,"work_id":"7a94cb02-a25e-498e-8e29-a4be9bec697c","year":1983},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:44.976560Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:56fca5e8c433ce398e1c133a1dafc588227b304e38b244b7afa600245e67b892","observation_id":"b8687f2b-90dd-4c2e-8cd4-b80a5d6710af","resolution":{"observed_at":"2026-08-06T20:35:57.005878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:56.719855Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"d09b06ec-65e0-41cc-bd50-e0ba2c02de0b","year":2016},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.035769Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:8dd8e8607f5820ff33ed3c7541d9dab0529b169e44babb148cebffcb4cdc6f35","observation_id":"26872b84-ea83-4f3e-a85e-7c26065e903b","resolution":{"observed_at":"2026-08-06T20:35:56.840878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/wics.1222","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":"Introduction to manifold learning","venue":"Wiley Interdisciplinary Reviews Computational Statistics","work_id":"3c358f37-58a7-413d-91d4-79a585626106","year":2012},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.111301Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:a14d33ca7bcaa25f1b945f1edd2269c1a339a334aeb0778d3683717702dc0a7e","observation_id":"aa00676b-f899-4e2f-8017-62284f9613a7","resolution":{"observed_at":"2026-08-06T20:35:49.676055Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:56.532467Z","title":"An Introduction to Statistical Learning (2nd Ed.)","venue":null,"work_id":"d3dbe5b4-4c14-4c41-a9cf-6ac63a82f213","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.198883Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:39f309cce56815b8603c7913ace71e804d3474f935602de74cce23110fb82d6e","observation_id":"ca21cb50-e602-4b66-8cfd-e1c26c98645f","resolution":{"observed_at":"2026-08-06T20:35:56.630270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:45.243438Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.243438Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:9c6dfcc1cf2d14d5569f2ca930ba55dbc103301d6ba388227779f629da5c2e18","observation_id":"2d4f180d-c4e7-46b0-8d99-31847779dd1e","resolution":{"observed_at":"2026-08-06T20:35:45.243438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:56.379258Z","title":"Deep learning without poor local minima","venue":null,"work_id":"10ec0253-6ac7-4807-9121-921bb134321f","year":2016},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.300787Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:e72f85dbc3322f915d0cd2ac084bffbc8c1b94cb5c5ffd875a3c22b35a373d77","observation_id":"e06c74d8-5f58-4fa8-ab5c-7a2c014d8ddc","resolution":{"observed_at":"2026-08-06T20:35:56.423948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:56.182139Z","title":"T., Wang, J., and Weber, M","venue":null,"work_id":"e37460ec-b6be-4762-9a22-e45644ea6e2e","year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.350616Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:daa097757c845ea7060ce36e9a6a8197bf1a19776dc94d1bc3e025a5f680695e","observation_id":"05dab68f-3e64-400e-bed8-57045b46b039","resolution":{"observed_at":"2026-08-06T20:35:56.278467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:56.018889Z","title":"and Langer, S","venue":null,"work_id":"d0660c32-6275-402b-8849-ee6bd23e3d0c","year":2021},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.429697Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:184617982622e0a76fcf03d032d8a51df5c31d1f93534dd1790a881efa97cea1","observation_id":"72e6be2a-ccd3-4ade-b4af-b0285726b29e","resolution":{"observed_at":"2026-08-06T20:35:56.098996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:55.842213Z","title":null,"venue":null,"work_id":"f6b2bcb7-cbd8-4883-9e23-592b8f80719a","year":2012},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.521785Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:b9a397e657500dc5dbc99234d1f950d889994c4c03670fd6798e51be03b3fbdf","observation_id":"731184ab-0d3c-4a20-8af1-19df8db0a9cb","resolution":{"observed_at":"2026-08-06T20:35:55.917425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:55.702417Z","title":"D., Oko, K., Suzuki, T., and Wu, D","venue":null,"work_id":"28280cd3-6f30-4393-964e-05690ab77607","year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.526743Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:82287f5035e94b99473d567da28db5cb3c8cbcfe64ca06f2cbc9de9c3014db8d","observation_id":"7b892b69-2bd8-43f0-9bf4-92808f0f2a1b","resolution":{"observed_at":"2026-08-06T20:35:55.773481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13256","last_updated":"2024-10-11T03:29:14Z","snapshot_observed_at":"2026-07-06T19:05:14.227812Z","submitted_at":"2024-08-23T17:59:03Z","title":"How Diffusion Models Learn to Factorize and Compose","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13256","snapshot_observed_at":"2026-08-06T20:35:45.581706Z","title":"How diffusion models learn to factorize and compose","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.581706Z"},"links":{"cited_paper":"/paper/2408.13256","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:d0b9d9d5c285ece099d09e1e077deb8d72ede4e7ed9e67008900fa9104b4952a","observation_id":"c39a7277-4305-41af-8a9d-40b39ba9a403","resolution":{"observed_at":"2026-08-06T20:35:45.581706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:55.531589Z","title":null,"venue":null,"work_id":"bb106f44-f2f0-4659-b51a-b52e3e690836","year":2025},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.658428Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:ea2bee4fa244a1606188f3fd55f4727012c4ce1026a9e087d041fb334688c9c4","observation_id":"2b082c95-24fa-4b0a-aa38-b8bb59dcafa9","resolution":{"observed_at":"2026-08-06T20:35:55.619673Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10749","last_updated":"2023-05-02T14:16:15Z","snapshot_observed_at":"2026-08-05T14:55:09.743440Z","submitted_at":"2022-10-19T17:45:48Z","title":"Transformers Learn Shortcuts to Automata","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.10749","snapshot_observed_at":"2026-08-06T20:35:45.748309Z","title":"T., Goel, S., Krishnamurthy, A., and Zhang, C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.748309Z"},"links":{"cited_paper":"/paper/2210.10749","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:11f4d6c7e983df3a548aeb990d7bcef92ea25e563b66bd852fa53e7dbeb608f8","observation_id":"9a3b1e9c-f6fe-44f1-9d6b-2972aaa0ce8d","resolution":{"observed_at":"2026-08-06T20:35:45.748309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06979","last_updated":"2024-07-29T20:51:25Z","snapshot_observed_at":"2026-07-30T13:47:26.976057Z","submitted_at":"2023-09-13T14:15:03Z","title":"Auto-Regressive Next-Token Predictors are Universal Learners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06979","snapshot_observed_at":"2026-08-06T20:35:45.863740Z","title":"Auto-regressive next-token predictors are universal learners","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.863740Z"},"links":{"cited_paper":"/paper/2309.06979","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:abc991835a075be099dc29e68ede3ba6cfb071410b0710da8c6494ecc00e512c","observation_id":"5bf35c01-612c-46e8-86fb-028b8ecd4be8","resolution":{"observed_at":"2026-08-06T20:35:45.863740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-1-4615-2696-4_11","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":"Learning Boolean Functions via the Fourier Transform, pp.\\ 391--424","venue":null,"work_id":"1462c582-a515-4a6d-bda0-0d038724655a","year":1994},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:45.936074Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:09ab3513408532d8cb291256b378b1f871b8e5a3f6eff2475435dd7c763a9f8b","observation_id":"b872bbc7-e1f4-4728-9ac9-4f6cc2423fb4","resolution":{"observed_at":"2026-08-06T20:35:49.554609Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:55.351198Z","title":"and Zhang, H","venue":null,"work_id":"b2c811e9-4c11-4318-b3dc-9189414b26f3","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.015301Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:a73fc4216229de6836b14df0499381bb4debc322e0cdd15a9689b7851905a825","observation_id":"a523dd33-fad3-43df-b0a7-c5bcb6b8030b","resolution":{"observed_at":"2026-08-06T20:35:55.417340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:55.124761Z","title":"Learning real and boolean functions: When is deep better than shallow? CBMM Memo \\#45, arXiv preprint, 2016","venue":null,"work_id":"83150aa1-ab13-424a-a4bf-4348b118758b","year":2016},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.061469Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:19117d6dcf8bd9bce6877d657bf548c8df59ac2efcba6f1cacf2f97f72a8b7f7","observation_id":"f3b0230c-03cb-414f-bdf6-cc9e443e5fef","resolution":{"observed_at":"2026-08-06T20:35:55.236917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01288","last_updated":"2022-11-03T22:44:21Z","snapshot_observed_at":"2026-07-06T14:13:39.478174Z","submitted_at":"2022-11-02T17:10:07Z","title":"Characterizing Intrinsic Compositionality in Transformers with Tree Projections","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01288","snapshot_observed_at":"2026-08-06T20:35:46.153360Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.153360Z"},"links":{"cited_paper":"/paper/2211.01288","citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:41e951e488d20c8e3685a61b84388d846e51640143de643d32e4f0e69ce42fce","observation_id":"6a5cef10-d278-4cc6-bc9d-07fefec90099","resolution":{"observed_at":"2026-08-06T20:35:46.153360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:54.949368Z","title":null,"venue":null,"work_id":"6a4421e9-6b30-47b5-8ba7-8b35b3efc33e","year":2012},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.263565Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:7806683b69574614894f81bd67d31395371e6f40776c728d5af0154f3ef4c9c7","observation_id":"a4fc79cf-eef3-4534-b034-180672d7b69f","resolution":{"observed_at":"2026-08-06T20:35:55.021714Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:46.323598Z","title":"and Simon, H","venue":null,"work_id":null,"year":1976},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.323598Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:0770dcbe63d7429996a751e432927957d5355d8b46c97368340874f3e4034d7c","observation_id":"53d9b589-5bd3-466e-a452-b580c8f717f4","resolution":{"observed_at":"2026-08-06T20:35:46.323598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:54.800722Z","title":null,"venue":null,"work_id":"a4d60265-63ac-418c-9286-26e9edb36c15","year":2017},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.410812Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:c3276cb1a35677822291bf4838e53432a4890d168a9ce9caf3df024a858449f0","observation_id":"a2faf52c-60b9-4365-b77f-f9cc50e680a3","resolution":{"observed_at":"2026-08-06T20:35:54.877809Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:54.615713Z","title":"Gpt-4 technical report","venue":null,"work_id":"478a59ba-7777-4e36-aca0-834dca9b6705","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.492087Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:f85dab1bc1d5997807ff7233753e5381fd346f9dfa8b89e8331932b7cd702772","observation_id":"53accd1a-8ac0-4098-896b-b80c2c4a3632","resolution":{"observed_at":"2026-08-06T20:35:54.699287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:54.477176Z","title":"The impact of depth on compositional generalization in transformer language models","venue":null,"work_id":"6872ff0c-f5aa-4742-bf45-d3f708b3d0a8","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.600158Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:d2bfc2c6bdd3f75c7d3808b6a029b40b4a0e6cca9ae6a3c96bf4f3300d6de117","observation_id":"1bd8dbf2-7bf2-4c65-8658-540cb9037e13","resolution":{"observed_at":"2026-08-06T20:35:54.525671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:54.310854Z","title":"On efficiently computable functions, deep networks and sparse compositionality","venue":null,"work_id":"2d66df1c-6f96-42aa-a140-0dd5de1ab5fc","year":2025},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.688775Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:27dac9320a329ab7104e2244a9dfa330b4a69fed8fdc3cfa4cf45d1975c5f0ff","observation_id":"3ee6e408-b621-4560-b9ed-c18a3c5add67","resolution":{"observed_at":"2026-08-06T20:35:54.401350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:46.837693Z","title":"and Fraser, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.837693Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:a75e26bdddb800ed93aa483719a910a5dedb94b267c64d97d65c27f69d739cc6","observation_id":"3f6dfcf2-09aa-442c-92d5-a62911b0a53f","resolution":{"observed_at":"2026-08-06T20:35:46.837693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:54.095381Z","title":"Why and when can deep-but not shallow-networks avoid the curse of dimensionality: A review","venue":null,"work_id":"46d88379-5f42-4cf7-a946-47544e90338f","year":2017},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:46.960322Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:382f827528b40ec70d685edd2b4a2d8420ebcc5140d851aa20e769beaf5a52b4","observation_id":"57e211e7-3e12-425a-920c-0e8c70aab84a","resolution":{"observed_at":"2026-08-06T20:35:54.219378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:53.887837Z","title":null,"venue":null,"work_id":"a1f40a0d-cfa9-4304-a9e9-316275c21fa7","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:47.113257Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:ed0ceb254cdff9f54f6e63147995d26b26dd9d957b47334ac7db84ce7830e641","observation_id":"62a9519f-7ade-4681-88d2-ac007bf95290","resolution":{"observed_at":"2026-08-06T20:35:54.011847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:47.302129Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:47.302129Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:c5c5d24bfad78359db326fb76cde07a739c176d562dfca81d73fa5cccc4bec12","observation_id":"5de9dea2-4a07-4ecf-88a0-20a7a30923f6","resolution":{"observed_at":"2026-08-06T20:35:47.302129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:47.434826Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:47.434826Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:183b22e1cd1e7da57d431881f4032b0d157b851463dbc2a60dbcfcdbecb617ff","observation_id":"9b94ad60-0589-408d-a197-5b2699f0ada7","resolution":{"observed_at":"2026-08-06T20:35:47.434826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:53.641909Z","title":"P., Dupont, E., Ruiz, F","venue":null,"work_id":"b5125654-0e63-4fa4-823b-bbbde4fe397d","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:47.565369Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:8d66a0e228885b1e505280a8691f46f9e570ff99ee209d627df770b974c2690d","observation_id":"1b6fdb02-357d-4b19-8c97-c32a4c5abcbf","resolution":{"observed_at":"2026-08-06T20:35:53.778454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:53.445307Z","title":"Nonparametric regression using deep neural networks with ReLU activation function","venue":null,"work_id":"4adb3921-8b20-4163-a031-af14fd921c24","year":2020},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:47.751370Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:9267a99d08341b4d5325956f3523e8299df20ff535ac9cba178cac56c6b926de","observation_id":"75bc159f-009c-421a-8d10-d5932b7a78b3","resolution":{"observed_at":"2026-08-06T20:35:53.541956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:53.231600Z","title":"J., Guez, A., Sifre, L., van den Driessche, G., Schrittwieser, J., Antonoglou, I., Panneershelvam, V., Lanctot, M., Dieleman, S., Grewe, D., Nand, D., et al","venue":null,"work_id":"26e6a7e6-f54d-4c25-88ef-f3364dcd94e9","year":2016},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:47.954028Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:b93a75e8e49049d9b666d8fcead33c2a4f43e8f2e33c8708ee00ef2ebd937764","observation_id":"820de09c-dec8-4782-85fa-b439b175fbcf","resolution":{"observed_at":"2026-08-06T20:35:53.348298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:48.078364Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.078364Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:fd7aef6c0827b2954b65200431f3ead3016d775060f29c72c07f1be09ed4035b","observation_id":"a318c086-e97c-474a-8e25-6b42054f15bd","resolution":{"observed_at":"2026-08-06T20:35:48.078364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:48.214114Z","title":"A general reinforcement learning algorithm that masters chess, shogi, and go through self-play","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.214114Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:60d41eef1b57e763c651de7a74c5fdcecd1a6282fdddb6a20c56f0a270bf13ee","observation_id":"8bed4428-2811-4aa4-983e-93ecccb2865d","resolution":{"observed_at":"2026-08-06T20:35:48.214114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:52.977762Z","title":"How sparse attention approximates exact attention?your attention is naturally \\ n c\\ -sparse","venue":null,"work_id":"c5f5e79d-9038-40ad-bdc7-6022ed77f4be","year":2025},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.368102Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:3ae510990b6f94755d830b87597dac9996e7ef5cb82b8a6cdf139f34d334cc27","observation_id":"d3bb53d1-a788-4c58-af60-6608a47867c5","resolution":{"observed_at":"2026-08-06T20:35:53.097686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:52.771448Z","title":"and Krause, A","venue":null,"work_id":"98dfe4c7-f200-46f1-a5ed-94a4cb005063","year":2012},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.470090Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:973ea8f975ad20b45e228ce91b3f1ba3feb73cdb63caec9a20e046510e427fbe","observation_id":"9af30030-b52c-4c81-bfab-9e1ad4549106","resolution":{"observed_at":"2026-08-06T20:35:52.871723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:48.615249Z","title":"H., Wu, Y., Le, Q","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.615249Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:cb37ad8154cb2bf1bb0a5c687dd9a67edd3f00d37780bec75295b5244ec47dbb","observation_id":"0840e7a4-581c-4a4c-9758-e4d7727af747","resolution":{"observed_at":"2026-08-06T20:35:48.615249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:52.521224Z","title":null,"venue":null,"work_id":"a33b7980-816f-413b-a641-fb0dcf759be9","year":1992},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.763584Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:de301715691ced6ac723683da7c7afe78c174e33d4466edef09fccd143d60d93","observation_id":"3b558b9c-d1a2-4aac-8494-1aac998b0b61","resolution":{"observed_at":"2026-08-06T20:35:52.666672Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:52.240900Z","title":null,"venue":null,"work_id":"2670e76e-b356-41bb-a145-eb802d82a3a0","year":2013},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.916005Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:8ce38823c9ce736941d3cab0147e58a94b5ebc978078a4422ef8abc0f15c5e62","observation_id":"ddcfaf34-3b60-4574-8a6a-fc8463b7b1d3","resolution":{"observed_at":"2026-08-06T20:35:52.370428Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:52.032400Z","title":"M., Parmar, N., Uszkoreit, J., Jones, L., Gomez, A","venue":null,"work_id":"c3f82cb5-0660-4230-807b-6136af6eda67","year":2017},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:48.985402Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:77e06b50bc5c7ee5dd3810059b11a0abab68e70d658823fad01c3efd979eaffb","observation_id":"0745daa3-2f6d-4db5-b793-ad5cd5902ec2","resolution":{"observed_at":"2026-08-06T20:35:52.124579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:51.787195Z","title":"and Belinkov, Y","venue":null,"work_id":"91490e0a-bd5a-4dd2-aec5-d9021bcbc001","year":2019},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:49.058097Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:0c7b29e4527e2dc9820492b240adf67722a9c46c4f2cfb21e09c367946304c8e","observation_id":"e71a933a-0aff-46f0-84db-9a680a601d64","resolution":{"observed_at":"2026-08-06T20:35:51.909365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:51.544061Z","title":"H., Xia, F., Le, Q., and Zhou, D","venue":null,"work_id":"d09010c7-6ae4-4a8a-af57-5401464e0491","year":2022},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:49.127526Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:8f8593c7bbca6ba71dd5ac1eb7f930aa23d61e74ec2010f6e39fa013528ed3ad","observation_id":"c3d7c163-7644-4388-abf8-4c3b4bc90192","resolution":{"observed_at":"2026-08-06T20:35:51.657602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:51.318477Z","title":null,"venue":null,"work_id":"958f5953-6b7a-4ba1-99a9-6e8e119cca66","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:49.198979Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:cccd840cfbc69edc3675d59d73d9c4381ce4e13250075af20b21ba37833f7aba","observation_id":"6d7a7c77-01ad-407d-88ba-bf5047774d2e","resolution":{"observed_at":"2026-08-06T20:35:51.438853Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:51.057172Z","title":"F., Solomon, E","venue":null,"work_id":"d6fb193a-a2de-45e6-9229-a21026b6624a","year":2014},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:49.247677Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:99a5dfbfd5805fd1c1078426fde240b19fb898853b69ee1aa517d111a2d5e009","observation_id":"3bafaca6-ce83-42fb-a7b4-b03ce3a05a02","resolution":{"observed_at":"2026-08-06T20:35:51.163429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:50.880551Z","title":"L., Cao, Y., and Narasimhan, K","venue":null,"work_id":"fb8579e2-b433-41a6-87b9-abf48d39ddd0","year":2023},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:49.298106Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:7a7cb783aee95fa9ecf93b467baf29133d19c07d7043f7e4f0486d2d418b45bf","observation_id":"e372e614-dc5c-4e90-a76a-6aeb54ba28c2","resolution":{"observed_at":"2026-08-06T20:35:50.956001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:35:50.648041Z","title":"Symmetry induces structure and constraint of learning","venue":null,"work_id":"03817cf3-2be5-468e-9b7d-b0770ac0ea37","year":2024},"citing_paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-06T20:35:49.377235Z"},"links":{"citing_paper":"/paper/2507.02550"},"observation_digest":"sha256:7f91f35a6d7df017492d0bd971e98d5f1cdc2303730d7c3cc5a50b04dc585dc3","observation_id":"0c017c28-23e7-48d8-bd84-39a6e78e2187","resolution":{"observed_at":"2026-08-06T20:35:50.757280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.02550","last_updated":"2025-07-03T11:49:56Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T20:24:01.502537Z","submitted_at":"2025-07-03T11:49:56Z","title":"Position: A Theory of Deep Learning Must Include Compositional Sparsity"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":5,"verified_fuzzy":40},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 5 inbound Pith citation observations for arXiv:2507.02550."}