{"as_of":"2026-08-09T12:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d102b1d4caf4653d0a6f854eae1863e622a621520e819015927f0bd27a3192c7","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T11:33:18.712887Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2510.04500/citation-record","integrity":"/paper/2510.04500/integrity","json":"/paper/2510.04500/citation-record.json","paper":"/paper/2510.04500"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:13.557312Z","title":"On the complexity of neural computation in superposition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:13.557312Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:b46c7fbe631207dfe06a7921e3b1e8d8304ce8b61b2a5f5bd7c7544f88e2c903","observation_id":"1c4b9164-73e9-48f1-bb6f-e7de55801d1b","resolution":{"observed_at":"2026-08-04T11:33:13.557312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08842","last_updated":"2025-05-05T19:19:37Z","snapshot_observed_at":"2026-08-09T05:35:21.416077Z","submitted_at":"2025-04-10T21:28:16Z","title":"Towards Combinatorial Interpretability of Neural Computation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08842","snapshot_observed_at":"2026-08-04T11:33:13.657166Z","title":"Towards combinatorial interpretability of neural computation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:13.657166Z"},"links":{"cited_paper":"/paper/2504.08842","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:4cc980834dea033188a29ac28d2a3ba464fec88a33f574dbd82a098827dbf245","observation_id":"4ecc8e7c-d5b2-40dd-9676-8c76e14d05a9","resolution":{"observed_at":"2026-08-04T11:33:13.657166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:13.774805Z","title":"The lottery ticket hypothesis for pre-trained bert networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:13.774805Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:d0a86df63f89d5bb22c33c7042b0f1c770e2172be3e73e42246ddc4f521e26b1","observation_id":"f1225378-5451-420a-8113-7d8fec206700","resolution":{"observed_at":"2026-08-04T11:33:13.774805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:13.829371Z","title":"The lottery tickets hypothesis for supervised and self-supervised pre-training in computer vision models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:13.829371Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:13dba535e1c62552edcf1a0086d4cba9f42f7a43ad99fabd6bcc101664a64863","observation_id":"718f3f4c-8c46-4b19-92c9-40c5c9119760","resolution":{"observed_at":"2026-08-04T11:33:13.829371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.05641","last_updated":"2016-04-23T23:14:39Z","snapshot_observed_at":"2026-07-06T04:36:52.555912Z","submitted_at":"2015-11-18T02:09:20Z","title":"Net2Net: Accelerating Learning via Knowledge Transfer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.05641","snapshot_observed_at":"2026-08-04T11:33:13.904579Z","title":"Net2net: Accelerating learning via knowledge transfer","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:13.904579Z"},"links":{"cited_paper":"/paper/1511.05641","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:37f86382f9a653132636296871429f8ba0599a26c17c84dd37a9db00b124c2c9","observation_id":"5086abc5-286b-4fa9-bde2-8334b87fcc53","resolution":{"observed_at":"2026-08-04T11:33:13.904579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:13.994761Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:13.994761Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:221124cc57e002cb428931961a67c3c994bf64210668d98395d6a708fab678c1","observation_id":"bef8eab3-90ef-4aa0-a094-efdd1e716db2","resolution":{"observed_at":"2026-08-04T11:33:13.994761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:14.087925Z","title":"Pure: Turning polysemantic neurons into pure features by identifying relevant circuits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:14.087925Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:c488cf1da95eaf2a260016d94f137dc6b2b2c170c431ef84903b31ddf7a9caf2","observation_id":"fd391cb1-75bc-4d5a-a0bc-60b0708f1bda","resolution":{"observed_at":"2026-08-04T11:33:14.087925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-04T11:33:14.244738Z","title":"Toy models of superposition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:14.244738Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:10c3bca14e9c53e33a371942069caa06cdb87752a4cd2744886a20c3abf15c40","observation_id":"a8d849f9-fcd8-4e34-884f-4fea884d1c69","resolution":{"observed_at":"2026-08-04T11:33:14.244738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:14.382121Z","title":"Rigging the lottery: Making all tickets winners","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:14.382121Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:48bb93d3792f48c3897c9c4bcaff65f7b0d104e6b37f78119d37900fbed840b2","observation_id":"969fb15b-01f2-45e4-8094-8dbce678d410","resolution":{"observed_at":"2026-08-04T11:33:14.382121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17481","last_updated":"2024-12-07T12:01:28Z","snapshot_observed_at":"2026-08-04T12:55:07.134932Z","submitted_at":"2024-09-26T02:37:41Z","title":"MaskLLM: Learnable Semi-Structured Sparsity for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17481","snapshot_observed_at":"2026-08-04T11:33:14.484741Z","title":"Maskllm: Learnable semi-structured sparsity for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:14.484741Z"},"links":{"cited_paper":"/paper/2409.17481","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:2e0f10d3a8a3f6110a512ca098a5a68cbd668ae74007152b2a67a5092728e94c","observation_id":"1d518cd7-da6e-44af-9ca1-a5f1dd62a5d1","resolution":{"observed_at":"2026-08-04T11:33:14.484741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.03635","last_updated":"2019-03-04T15:51:11Z","snapshot_observed_at":"2026-08-05T23:54:27.386622Z","submitted_at":"2018-03-09T18:51:28Z","title":"The Lottery Ticket Hypothesis: Finding Sparse, Trainable Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.03635","snapshot_observed_at":"2026-08-04T11:33:14.588254Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:14.588254Z"},"links":{"cited_paper":"/paper/1803.03635","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:47a0e129016d86180a676d26efc4127c202b27c1f6c57dad11512025c773683e","observation_id":"5d03d10e-14a7-460b-a94f-2499c6fd9014","resolution":{"observed_at":"2026-08-04T11:33:14.588254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:14.669407Z","title":"Sparsegpt: Massive language models can be accurately pruned in one-shot","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:14.669407Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:8c447146ded4914fa3aeaf4375ff9e377901b7c1f2eb04a1e93e9f192e412821","observation_id":"f14b2c87-ade7-416b-9e06-52439f227372","resolution":{"observed_at":"2026-08-04T11:33:14.669407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:14.791682Z","title":"Multimodal neurons in artificial neural networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:14.791682Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:d2019a4ea76f8b99fbb922f8a924460bfe2f071cd0d5f034a6cbf204e6168869","observation_id":"6fd936e0-445f-4980-8a79-c059e27133b6","resolution":{"observed_at":"2026-08-04T11:33:14.791682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.14495","last_updated":"2021-04-30T23:51:44Z","snapshot_observed_at":"2026-07-06T10:09:06.864468Z","submitted_at":"2020-10-27T17:53:49Z","title":"Are wider nets better given the same number of parameters?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.14495","snapshot_observed_at":"2026-08-04T11:33:14.924940Z","title":"Are wider nets better given the same number of parameters? arXiv preprint arXiv:2010.14495, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:14.924940Z"},"links":{"cited_paper":"/paper/2010.14495","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:317ae539f95f5686748bff63273d20381d301dc3cb888431ec02185f8f011215","observation_id":"5ab5f514-f0e2-4fd7-a162-f630313c056d","resolution":{"observed_at":"2026-08-04T11:33:14.924940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-07-06T17:18:56.465394Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-04T11:33:15.014741Z","title":"Universal neurons in gpt2 language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:15.014741Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:a90f00ad1a64fe29fbb950d2ddc0d0ee945ee8ce5b4cda5013e05f322bc4384d","observation_id":"54340b46-e7cd-436c-8ace-784b398c07b5","resolution":{"observed_at":"2026-08-04T11:33:15.014741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:15.124801Z","title":"Learning both weights and connections for efficient neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:15.124801Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:be3ab0d035797afcc6b778af2c01e17c9b00c734f5ffd87e3e0b1ce3944a7627","observation_id":"b04190b8-67f7-40e5-852f-a6614060038e","resolution":{"observed_at":"2026-08-04T11:33:15.124801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:15.177038Z","title":"Dynamic neural networks: A survey","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:15.177038Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:3ef73b70edda8788c603fbda0b15f67e72419d4497e968a8fc03532f9b3022ff","observation_id":"1696d495-f987-4c85-86c1-f35dfdc58ce5","resolution":{"observed_at":"2026-08-04T11:33:15.177038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05451","last_updated":"2024-08-10T06:11:48Z","snapshot_observed_at":"2026-08-03T18:17:19.877694Z","submitted_at":"2024-08-10T06:11:48Z","title":"Mathematical Models of Computation in Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05451","snapshot_observed_at":"2026-08-04T11:33:15.465355Z","title":"Mathematical models of computation in superposition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:15.465355Z"},"links":{"cited_paper":"/paper/2408.05451","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:55079d7a8b88669d0f007481ca3f6848e24eb4c4e5df8120ac969f656b8f8bc1","observation_id":"40ea786c-a2c5-4d8c-81d1-c329910fcffb","resolution":{"observed_at":"2026-08-04T11:33:15.465355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09169","last_updated":"2022-11-16T19:32:43Z","snapshot_observed_at":"2026-08-08T01:34:37.669129Z","submitted_at":"2022-11-16T19:32:43Z","title":"Engineering Monosemanticity in Toy Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09169","snapshot_observed_at":"2026-08-04T11:33:15.807379Z","title":"Engineering monosemanticity in toy models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:15.807379Z"},"links":{"cited_paper":"/paper/2211.09169","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:ffe07bf31dd0de34b96c00602afda3c5d0e172155a46bdafe5746fcd9f948861","observation_id":"eb4b2656-3cd9-446f-8c90-fc98628569a1","resolution":{"observed_at":"2026-08-04T11:33:15.807379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:15.905776Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:15.905776Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:aca4c2e678068f45e67955668072df10d52ec57584f365386550e9f1036b3343","observation_id":"f40b7283-0cfc-4739-a6f0-26d697aae671","resolution":{"observed_at":"2026-08-04T11:33:15.905776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03096","last_updated":"2024-02-13T06:26:22Z","snapshot_observed_at":"2026-08-03T14:18:36.740566Z","submitted_at":"2023-12-05T19:29:54Z","title":"What Causes Polysemanticity? An Alternative Origin Story of Mixed Selectivity from Incidental Causes","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03096","snapshot_observed_at":"2026-08-04T11:33:15.991947Z","title":"What causes polysemanticity? an alternative origin story of mixed selectivity from incidental causes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:15.991947Z"},"links":{"cited_paper":"/paper/2312.03096","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:f7057ce6e9e8c07f1778b3094a9b1f2d5ea8fce0bb8c7b27778d55e9dc95093d","observation_id":"16866f60-31c4-42d0-9da2-875eb330aa20","resolution":{"observed_at":"2026-08-04T11:33:15.991947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04861","last_updated":"2024-03-12T18:35:48Z","snapshot_observed_at":"2026-08-09T09:48:58.224695Z","submitted_at":"2024-03-07T19:27:01Z","title":"A Survey of Lottery Ticket Hypothesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04861","snapshot_observed_at":"2026-08-04T11:33:16.090153Z","title":"A survey of lottery ticket hypothesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:16.090153Z"},"links":{"cited_paper":"/paper/2403.04861","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:9059a4a9f6fcc323ca9ddf8f98e6f6858fbc3d3e8edf53ffaf6f528e3eec1537","observation_id":"13952b60-c9bd-40a8-aef1-1107bdc77dd9","resolution":{"observed_at":"2026-08-04T11:33:16.090153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10465","last_updated":"2025-11-29T21:39:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-15T16:18:13Z","title":"Superposition Yields Robust Neural Scaling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10465","snapshot_observed_at":"2026-08-04T11:33:16.244738Z","title":"Superposition yields robust neural scaling, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:16.244738Z"},"links":{"cited_paper":"/paper/2505.10465","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:a34a7bc1c75b44db8694b3748f1873451faf5a146f97c6386e03005c103b0e78","observation_id":"1edc2362-95b0-4b44-bf94-b6241aeff5bf","resolution":{"observed_at":"2026-08-04T11:33:16.244738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:16.354740Z","title":"Proving the lottery ticket hypothesis: Pruning is all you need","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:16.354740Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:d8ac7cfcf03527dc226a4191d243fcb44da7103f2038eadd80a1c6acdaadc3c6","observation_id":"61cb87d9-b096-4f8f-a757-3996f5cf17d6","resolution":{"observed_at":"2026-08-04T11:33:16.354740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:16.454736Z","title":"Analysis of boolean functions","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:16.454736Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:20ed026c1f1e14973287c829069f6b1f9f1ac88fd29925fea7ad048547e1602f","observation_id":"3b6204f2-53a5-478b-baa9-c1f98cd05ad9","resolution":{"observed_at":"2026-08-04T11:33:16.454736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:16.535988Z","title":"Zoom in: An introduction to circuits","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:16.535988Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:0c654faba38888903a34301da481f171d4c391c729056347f9199ec4aeacec44","observation_id":"fc42be5c-6667-4136-8bd4-4e920162d553","resolution":{"observed_at":"2026-08-04T11:33:16.535988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:16.634903Z","title":"Mixturegrowth: Growing neural networks by recombining learned parameters","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:16.634903Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:d047eed2f1d85bfc318066fb1ca77f179b2328a67daac82ac8cb26c52159d4b4","observation_id":"3fb9ff1c-6154-4124-acf8-ad77d0ea299f","resolution":{"observed_at":"2026-08-04T11:33:16.634903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:16.744903Z","title":"Accelerating inference with sparsity using the nvidia ampere architecture and nvidia tensorrt","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:16.744903Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:5f156d363ad2d90cd4164355c42cf9a52145a3147c0a4dbe7668d53cd8ece006","observation_id":"27f6956f-4b6b-4ac4-a88b-96f48c798b55","resolution":{"observed_at":"2026-08-04T11:33:16.744903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:16.864999Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:16.864999Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:fda6c718dfd2ce319df5efc7debf04f38ffde6b3b08eb9ff814ee32a71c2ae7c","observation_id":"9c3a1ff8-ae13-4c44-a857-61eea2e9d919","resolution":{"observed_at":"2026-08-04T11:33:16.864999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01892","last_updated":"2025-03-25T05:19:03Z","snapshot_observed_at":"2026-08-09T07:30:27.772190Z","submitted_at":"2022-10-04T20:28:43Z","title":"Polysemanticity and Capacity in Neural Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01892","snapshot_observed_at":"2026-08-04T11:33:16.977876Z","title":"Polysemanticity and capacity in neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:16.977876Z"},"links":{"cited_paper":"/paper/2210.01892","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:c00ee313886f94a970af5c9608227674d15a5350efeb8c0e410c49a193c68b15","observation_id":"dd19aae6-2d35-4514-88d1-a725bd6b083a","resolution":{"observed_at":"2026-08-04T11:33:16.977876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-04T11:33:17.067257Z","title":"A simple and effective pruning approach for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:17.067257Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:d1e5ea5b3ae8559c9f5e64a20ddd0395047229eec0a332db6c382ee9aa3a2789","observation_id":"ca2e2831-8dae-4016-b213-9f1d45f4f04e","resolution":{"observed_at":"2026-08-04T11:33:17.067257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:17.164936Z","title":"Firefly neural architecture descent: a general approach for growing neural networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:17.164936Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:023eb0ccb70a1dfe593e653ec8efec5a2fd7424696c0802dc850fbf8208d271f","observation_id":"38d47441-2ea0-460d-b855-7fd2b2c92273","resolution":{"observed_at":"2026-08-04T11:33:17.164936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.07747","last_updated":"2017-09-15T21:29:49Z","snapshot_observed_at":"2026-07-06T05:56:41.814255Z","submitted_at":"2017-08-25T14:01:29Z","title":"Fashion-MNIST: a Novel Image Dataset for Benchmarking Machine Learning Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.07747","snapshot_observed_at":"2026-08-04T11:33:17.270238Z","title":"Fashion-mnist: a novel image dataset for benchmarking machine learning algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:17.270238Z"},"links":{"cited_paper":"/paper/1708.07747","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:017546184075e4ecbb18677a8296e45e41f0a503460032e18c97b00b44338c44","observation_id":"2a288065-efe8-4b02-ad47-d4d8a6a54bbb","resolution":{"observed_at":"2026-08-04T11:33:17.270238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:17.374816Z","title":"An effective gram matrix characterizes generalization in deep networks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:17.374816Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:720e07ad721f47850aacec928feb04e6422ce64214a633e783960eb851d659da","observation_id":"1db67381-35de-408a-8c80-805b3d2c7aa8","resolution":{"observed_at":"2026-08-04T11:33:17.374816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.15353","last_updated":"2023-06-06T03:20:50Z","snapshot_observed_at":"2026-08-02T11:09:21.725311Z","submitted_at":"2020-07-30T10:03:47Z","title":"Growing Efficient Deep Networks by Structured Continuous Sparsification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.15353","snapshot_observed_at":"2026-08-04T11:33:17.474748Z","title":"Growing efficient deep networks by structured continuous sparsification","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:17.474748Z"},"links":{"cited_paper":"/paper/2007.15353","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:ec502f0fc6ad796cf7b6317419f52a28a8445ea864d9cf7cd83a96c70d5d5d05","observation_id":"0bff169f-713c-4fec-b2ce-cf1dd358f694","resolution":{"observed_at":"2026-08-04T11:33:17.474748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:17.574889Z","title":"Deconstructing lottery tickets: Zeros, signs, and the supermask","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:17.574889Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:0847b637b3f2689170ee75eeb8b23f598124d9bf98fe748fb63eceb038c6accd","observation_id":"e92a1b55-92f4-4007-8b67-faf1b59065f2","resolution":{"observed_at":"2026-08-04T11:33:17.574889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:18.177280Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:18.177280Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:f8cd8169ccc3ebbe70a70558caa379a0f935dc795a0ca2a72c560597fb2cc8c6","observation_id":"b6d2bd59-26b7-464b-88ac-838a4cd903ac","resolution":{"observed_at":"2026-08-04T11:33:18.177280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:18.334748Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:18.334748Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:fc03ebc672311066b6d9204f8125d2676eba6db9cfb9f311f3170b56105dfce0","observation_id":"e40ee65a-09fd-490d-8334-2c982606a9f9","resolution":{"observed_at":"2026-08-04T11:33:18.334748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:18.537816Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:18.537816Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:99028ebcdbf471417a201046cb1d0ac7dc11dd0f680d9ab4e32be05d83ee12b3","observation_id":"1452af98-d1e0-4ed1-8583-7018278cbc3e","resolution":{"observed_at":"2026-08-04T11:33:18.537816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T11:33:18.712887Z","title":"I D ocٙ\\^9;g=;;3g DDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDD suDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDD䘘 TDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDDD &&","venue":null,"work_id":null,"year":2080},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:18.712887Z"},"links":{"citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:7ac0f484ed327107948e6f38a1b524870c90afc5283503ea5001543a03ace16c","observation_id":"b671efc4-b48c-4af8-a11c-b06ce82ffb6a","resolution":{"observed_at":"2026-08-04T11:33:18.712887Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T18:27:51.712711Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2510.04500."}