{"as_of":"2026-08-06T00:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e05fc9ce41312827d212a89feaf34325f98581273c1141a3dfd0261b5767ee77","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:54:42.655542Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.00362/citation-record","integrity":"/paper/2509.00362/integrity","json":"/paper/2509.00362/citation-record.json","paper":"/paper/2509.00362"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2106.10165","last_updated":"2021-08-24T17:12:56Z","snapshot_observed_at":"2026-07-06T11:20:46.393822Z","submitted_at":"2021-06-18T15:00:00Z","title":"The Principles of Deep Learning Theory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.10165","snapshot_observed_at":"2026-08-05T13:54:38.337984Z","title":"Hanin, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:38.337984Z"},"links":{"cited_paper":"/paper/2106.10165","citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:e1fb13c42ad4adf5f0f26869152aeb1e3600853a1059052f5204f89f84ae3691","observation_id":"e4aa0bc7-9e5a-44d7-9138-4ab5b4f3b988","resolution":{"observed_at":"2026-08-05T13:54:38.337984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:49.560144Z","title":"Goodfellow, Y","venue":null,"work_id":"d2de763e-9fc2-4838-a455-9ab87f14bccb","year":2016},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:38.435727Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:f704882aaad8c630e4c2d5ccca38845eb506e35359b723b13dace050c433ac9e","observation_id":"eb3e46d1-ddea-4f89-9962-93a51c5bdf49","resolution":{"observed_at":"2026-08-05T13:54:49.641890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:49.373011Z","title":"Learning deep architectures for ai,","venue":null,"work_id":"bcf4f416-b800-482c-866b-9b3572e86a16","year":2009},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:38.508333Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:fca42f5c7836820603cde3b8396f154fbdac081ad9a6ffee75d0970081f4edb5","observation_id":"545a1f57-a38d-41a6-b8d0-96025c70060f","resolution":{"observed_at":"2026-08-05T13:54:49.426227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:38.585150Z","title":"Deep learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:38.585150Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:96c34abd8d5750fddfa1d6e45dccb45f08f8a26167e81d067c79147072db8e1a","observation_id":"16eb901e-4d48-473d-8263-e25e8ad01293","resolution":{"observed_at":"2026-08-05T13:54:38.585150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:38.661587Z","title":"Understanding the difficulty of training deep feedforward neural networks,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:38.661587Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:071e9eab2750a44671b439ddb640625cccfc74abb251bb00a05e4ee1aa264223","observation_id":"b8556232-9b0e-4d06-80ad-567df169b552","resolution":{"observed_at":"2026-08-05T13:54:38.661587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:49.112336Z","title":"Rectified linear units improve restricted boltzmann machines,","venue":null,"work_id":"58434895-afac-4688-8f40-3682c7183205","year":2010},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:38.782904Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:c50070cce01803206a0adcdaccbca376f0ea32a3551ca47fcabdab85fa913ac7","observation_id":"3db7f36d-6171-40f3-b94b-70dec21a8216","resolution":{"observed_at":"2026-08-05T13:54:49.217684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:48.963193Z","title":"Rectifier nonlinearities improve neural network acoustic models,","venue":null,"work_id":"90dabbc3-cac3-4eec-a15e-a4975221aafd","year":2013},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:38.892289Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:c0aa92d693a22a7adca9a0f9529b200cf3da3f4ba7becd55e29abf9e84d451e0","observation_id":"96b7fce7-9f10-4413-81d7-84976f8f4933","resolution":{"observed_at":"2026-08-05T13:54:49.017961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:39.009593Z","title":"Delving deep into rectifiers: Surpassing human-level performance on imagenet classification,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.009593Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:b406d40cb98c34cd86dd997fe23e320a50f01ef5f86d96ff05cf606dd286b4fa","observation_id":"0f294dad-f83a-437c-b11b-1adace5a5f99","resolution":{"observed_at":"2026-08-05T13:54:39.009593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.07289","last_updated":"2016-02-22T07:02:58Z","snapshot_observed_at":"2026-07-06T04:37:28.029641Z","submitted_at":"2015-11-23T15:58:05Z","title":"Fast and Accurate Deep Network Learning by Exponential Linear Units (ELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.07289","snapshot_observed_at":"2026-08-05T13:54:39.091827Z","title":"Fast and accurate deep network learning by exponential linear units (elus),","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.091827Z"},"links":{"cited_paper":"/paper/1511.07289","citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:8e76640ee17a89faaf65e992961a7b9dd2380b1c4ec5d2d73498b1591ea6ffc7","observation_id":"6c00c4bd-60ce-459d-b28d-b17ffef4afea","resolution":{"observed_at":"2026-08-05T13:54:39.091827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:39.196225Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.196225Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:b52076a6d52ae165b73d15232722ce3e61a91b15b9a361b4925f2fd9720861a8","observation_id":"37c2f40e-c271-4a72-ad5a-c3bd5279d82d","resolution":{"observed_at":"2026-08-05T13:54:39.196225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:48.737232Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift,","venue":null,"work_id":"b7c1797a-161f-4a60-89ba-64ec2c77ace6","year":2015},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.299662Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:1de3dbbf05ce690b9924027abef05619495cbe7fea6fc2c5bf075c3e025a5a2d","observation_id":"a749d5d2-567e-4753-a16c-7454e20071af","resolution":{"observed_at":"2026-08-05T13:54:48.831261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:48.472806Z","title":"Resurrecting the sigmoid in deep learning through dynamical isometry: theory and practice,","venue":null,"work_id":"c78b629e-e1dd-4dd2-9bfc-28c97aa2cfef","year":2017},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.396828Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:07d2eae0738013683f7e008cb0665ee2ce70327995c81ce1b3769ca54bfb949f","observation_id":"e7664735-e697-4e83-b4d2-36e3bfc4b706","resolution":{"observed_at":"2026-08-05T13:54:48.602039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6120","last_updated":"2014-02-19T17:26:57Z","snapshot_observed_at":"2026-08-01T19:05:53.906854Z","submitted_at":"2013-12-20T20:24:00Z","title":"Exact solutions to the nonlinear dynamics of learning in deep linear neural networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6120","snapshot_observed_at":"2026-08-05T13:54:39.504363Z","title":"Exact solutions to the nonlinear dynamics of learning in deep linear neural networks,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.504363Z"},"links":{"cited_paper":"/paper/1312.6120","citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:47836000489b1300aa53e76094674289e4f2f19cfba4c261d20c385ea30998b1","observation_id":"2e7de407-4a55-4d88-8128-f98ce33ada94","resolution":{"observed_at":"2026-08-05T13:54:39.504363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:48.303702Z","title":"Improved weight initialization for deep and narrow feedforward neural network,","venue":null,"work_id":"4eea0d00-a118-41ab-8431-4d443a878802","year":2024},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.605430Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:cdbb61ce2a01936c5fd40b2640f796bae71eea0bf16b9372717c41a3d4be0d64","observation_id":"8df18806-8dee-476a-9ef4-37536b392467","resolution":{"observed_at":"2026-08-05T13:54:48.391769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:39.698745Z","title":"Gradient-based learning applied to document recognition,","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.698745Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:718ee25523e2c829ed655ea3ccd8efbe695f6801ee5087ca040226ee201cf367","observation_id":"9852b251-9cd6-4f0e-b23e-fd64527a498a","resolution":{"observed_at":"2026-08-05T13:54:39.698745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:48.059549Z","title":"Greedy layer-wise training of deep networks,","venue":null,"work_id":"ace5bc4c-21fd-498e-ad3c-2a58031cc037","year":2006},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.818237Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:bc340ae01a69687488064ad178bea905470977a3c1c1c5fe81718baae5427461","observation_id":"9bbafe7b-d449-4fe0-9bd1-b669fd9c39f4","resolution":{"observed_at":"2026-08-05T13:54:48.159720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:47.879208Z","title":"Learning repre- sentations by back-propagating errors,","venue":null,"work_id":"c5cb36a8-aca9-49d0-a237-3b7283b6ea2a","year":1986},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.931751Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:9a8ff133fe56b9c46682199af48a81ce898601f5e35c3a959bf72f90c7926079","observation_id":"b29e9942-9c55-4277-9433-e902fc8a8590","resolution":{"observed_at":"2026-08-05T13:54:47.969909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:47.627213Z","title":"Backpropagation applied to handwritten zip code recognition,","venue":null,"work_id":"82255bf6-6542-45d6-9acb-60fbdf0ca0a1","year":1989},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.019956Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:3cd1efcf4d83239eb0edb31dc2ccd2bb979e462577fc03e67a828f2650592ed8","observation_id":"47b2b7fb-4ce4-4127-8047-007a5efe0f00","resolution":{"observed_at":"2026-08-05T13:54:47.753489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.06733","last_updated":"2020-10-21T19:19:02Z","snapshot_observed_at":"2026-07-06T07:39:37.521800Z","submitted_at":"2019-03-15T18:23:55Z","title":"Dying ReLU and Initialization: Theory and Numerical Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.06733","snapshot_observed_at":"2026-08-05T13:54:40.117887Z","title":"Dying relu and initializa- tion: Theory and numerical examples,","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.117887Z"},"links":{"cited_paper":"/paper/1903.06733","citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:e46da8b546898b5942c6c7e430094ba3f4575c5a9c31b51d3ad0680f1ce69d7c","observation_id":"df1e04ef-e002-4421-b7b4-dc71ddd32eed","resolution":{"observed_at":"2026-08-05T13:54:40.117887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:47.401140Z","title":"Robust weight initialization for tanh neural networks with fixed point analysis,","venue":null,"work_id":"3f11fc44-8810-4cde-aaaa-6dafe55d72d6","year":2025},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.220346Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:96b28642dad581f04a052b35b58b3c68113f587b7da76fdcc4d38a85a6c2ad26","observation_id":"fb25dd60-b402-40b0-9342-c3bd2767945f","resolution":{"observed_at":"2026-08-05T13:54:47.505430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:47.134695Z","title":"Revisiting weight initialization of deep neural networks,","venue":null,"work_id":"3aaed8a2-e33a-4d40-9140-b9c698d89938","year":2021},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.299763Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:246005443c42096c73bef8eefdf2208a7b3e3c9669de554eb044735d41271f8a","observation_id":"992c3cc1-1e2b-42b5-bdb6-65452b67badb","resolution":{"observed_at":"2026-08-05T13:54:47.253192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:46.804687Z","title":"Provable benefit of orthogonal initialization in optimizing deep linearnetworks,","venue":null,"work_id":"eeeb49e5-f9a9-403a-96ea-6eedb58c1160","year":2020},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.407624Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:e327a020540a08318e91f14d3f001aedd0f03dcdd5c66f7821ff019278b94b86","observation_id":"49db1ae4-ae3d-43b0-89d1-d8fcabd6e020","resolution":{"observed_at":"2026-08-05T13:54:46.926542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.03426","last_updated":"2020-09-18T01:56:41Z","snapshot_observed_at":"2026-08-02T15:32:07.466568Z","submitted_at":"2018-02-09T19:39:33Z","title":"UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.03426","snapshot_observed_at":"2026-08-05T13:54:40.453364Z","title":"Umap: Uniform manifold approximation and projection for dimension reduction,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.453364Z"},"links":{"cited_paper":"/paper/1802.03426","citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:8846903b10a9ae9fecaf9941484916ee9bf130e58e3aaa2f6179f9399078d1ec","observation_id":"68f188dd-950c-4bd2-8db3-36e116f81b6a","resolution":{"observed_at":"2026-08-05T13:54:40.453364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:46.556129Z","title":"Computational optimal transport: With applications to data science,","venue":null,"work_id":"af37d065-2547-4319-a041-91c0cdb20270","year":2019},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.550669Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:968cf800fea223afea36633b5e4b4ad5ca9d5936713826542d5aaa929b2f666f","observation_id":"b0a7a0b3-39f4-4558-9391-5cdde1e52974","resolution":{"observed_at":"2026-08-05T13:54:46.681510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:40.640379Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.640379Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:17ab9aed105b95d91ae1fbbe92e77af2ae5f98b5b3a10b9d4fd17ee6d7d91279","observation_id":"50e763ff-8fe3-409a-92da-b9981251a4de","resolution":{"observed_at":"2026-08-05T13:54:40.640379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"math-ph/0609050","last_updated":"2007-02-27T14:22:05Z","snapshot_observed_at":"2026-07-07T06:16:50.870997Z","submitted_at":"2006-09-18T11:18:42Z","title":"How to generate random matrices from the classical compact groups","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"math-ph/0609050","snapshot_observed_at":"2026-08-05T13:54:40.704791Z","title":"How to generate random matrices from the classical compact groups,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.704791Z"},"links":{"cited_paper":"/paper/math-ph/0609050","citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:c1cfff83ced9bbc96bc944b6b500b0bad3c25978a0b7711af5f7c0449891dca8","observation_id":"c62ef329-0ff5-43a1-aff2-fc0471f683c9","resolution":{"observed_at":"2026-08-05T13:54:40.704791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:46.236602Z","title":null,"venue":null,"work_id":"d93863ef-372a-4bb1-8526-75007503a01a","year":2002},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.812459Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:f83e1e54d8979acbdc4266112395f98339a32897e0c6d211c73eb6c018b051a4","observation_id":"3340867c-22c0-46f0-8f1a-86f103cf3e93","resolution":{"observed_at":"2026-08-05T13:54:46.362403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:45.965855Z","title":"Mean field residual networks: On the edge of chaos,","venue":null,"work_id":"ea0b7a49-11b1-4e9f-b48b-6e6d5e882f5d","year":2017},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.891169Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:f3731a23eebd625e523caf751e1e7d4f7931e56e4fa3851d76a592ed29b574fc","observation_id":"63fdffbe-224f-444b-8031-9f209299d1e6","resolution":{"observed_at":"2026-08-05T13:54:46.065471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:45.707387Z","title":"Skewness and kurtosis in real data samples,","venue":null,"work_id":"26ee111a-5c94-4cf7-84cb-ff2f9d2a41ab","year":2013},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.000472Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:721d2a067c819763d4c320bb051868598fa2a36318823e3474abe32f1428672c","observation_id":"f07fb28b-ef17-4a94-b81b-c6be7d2c9732","resolution":{"observed_at":"2026-08-05T13:54:45.831819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:45.506913Z","title":"Transforming variables to central normality,","venue":null,"work_id":"4633bac3-7467-40d0-9b4b-ed122f0e6111","year":2024},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.099749Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:7ef23bf59838856b790a6f7d02045b210edebc269837a2911f2fed3398163922","observation_id":"5be93ecb-e2e5-4784-a979-cfb714cabfb8","resolution":{"observed_at":"2026-08-05T13:54:45.585323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:45.335626Z","title":"A comparison principle for functions of a uniformly random subspace,","venue":null,"work_id":"0cfdfb8e-21ec-4bf4-baa4-ec6c79b0b79b","year":2012},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.243232Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:e915dfd23ca5d440515709acab889bd55c6839732e742d43411abf7250723dbc","observation_id":"a9ce912d-6ebd-4f40-b737-63349f450ebb","resolution":{"observed_at":"2026-08-05T13:54:45.417588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:45.194284Z","title":"Maxima of entries of haar distributed matrices,","venue":null,"work_id":"ade7ec2d-4820-4a08-b6bb-670c15ea2445","year":2005},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.367869Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:495ea93f157916b6f7e160cf350af7fca9ce94eb97f0962fc3f266e925f68164","observation_id":"2cc4855d-b4ac-497a-b5d4-03e4c6d9b4c2","resolution":{"observed_at":"2026-08-05T13:54:45.266258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:45.053823Z","title":"A multivariate berry–esseen theorem with explicit constants,","venue":null,"work_id":"2dc23d14-60d5-4ad6-9808-831922dd06d5","year":2019},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.474512Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:7d635f1d2e1159b575b430355efb153fdcf35263b2cc0ab81ee4efb0c50eb60a","observation_id":"b748df7b-a0bb-4c10-a1fd-4537dc5f68a4","resolution":{"observed_at":"2026-08-05T13:54:45.125585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:44.881412Z","title":null,"venue":null,"work_id":"dd245924-1c2e-416a-b6f5-2fdc8f69f97f","year":2000},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.609288Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:018b412c42a93ca63edbb9b5660d1126b96f9d6243390eae84109b89782f49aa","observation_id":"22ea0ccd-1623-411c-aa17-71f71db790c6","resolution":{"observed_at":"2026-08-05T13:54:44.954032Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01232","last_updated":"2017-04-04T19:36:14Z","snapshot_observed_at":"2026-07-06T05:17:20.642708Z","submitted_at":"2016-11-04T00:44:32Z","title":"Deep Information Propagation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01232","snapshot_observed_at":"2026-08-05T13:54:41.698132Z","title":"Deep information propagation,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.698132Z"},"links":{"cited_paper":"/paper/1611.01232","citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:f3bc1a14123d6a9e853b29b77719870ba7b3b7850bfe7fb50635edf535fa29fd","observation_id":"b09b980d-6478-4ff2-b8c9-3f232b86d2ac","resolution":{"observed_at":"2026-08-05T13:54:41.698132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:44.732541Z","title":"On numerical computation for the distribution of the convolution of N independent rectified Gaussian variables,","venue":null,"work_id":"2475aa9b-0b41-438a-9ff2-549da5af4851","year":2018},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.830597Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:31f9f8d2cef69aaf8f398df5b7e59f62262505ee767f0c3e43e94e502c630ae2","observation_id":"d73c2608-812b-4481-a942-17f09ada5173","resolution":{"observed_at":"2026-08-05T13:54:44.809342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:44.555003Z","title":"An analytic solution to covariance propagation in neural networks,","venue":null,"work_id":"8914efab-9415-4d0e-b14b-73acf5fc311d","year":2024},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.929977Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:410be656e329b78df760c85b0a512cf6d54768adf5c280b43ac9bdb12988d1d6","observation_id":"89cc8e28-2522-4a55-be14-290b9ce4385f","resolution":{"observed_at":"2026-08-05T13:54:44.638529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:44.372216Z","title":"How to start training: The effect of initialization and architecture,","venue":null,"work_id":"d5c713a7-6a77-4d72-99ff-8dd0891fa212","year":2018},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.038297Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:a226821a2a11bb357b339ea2da2cfe887615e1a0669811480fba393a05974939","observation_id":"f4f919c9-1bd7-4544-8042-9b6d310462b5","resolution":{"observed_at":"2026-08-05T13:54:44.478154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:44.197874Z","title":"Tensor programs VI: Feature learning in infinite depth neural networks,","venue":null,"work_id":"dd70cd33-d77e-465b-ae5e-6d175c70b83d","year":2024},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.108317Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:8a6aed7cbe50aa460174781da5add65f8b3228edc6163ee45d1ca593a4c7109a","observation_id":"5dc06971-54f9-4f6b-aae9-77d7cf93878f","resolution":{"observed_at":"2026-08-05T13:54:44.300378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:44.030716Z","title":"Self- normalizing neural networks,","venue":null,"work_id":"96b4b7e4-addc-4050-83fc-c7c3ba19cb2f","year":2017},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.192754Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:5111606ce14d6f221ed6e5a314e545fc8e969196003c95402ccbcbb4603b6332","observation_id":"ea2258ea-e22e-46d4-9b71-3840855cdd06","resolution":{"observed_at":"2026-08-05T13:54:44.090831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:43.856153Z","title":"Becker and R","venue":null,"work_id":"51a39532-391f-4e51-866c-2c274cd4bfca","year":1996},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.254056Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:1d7b58e8d79ddd3970869f8811f4dee34b706ee4c683cf9b40ec77fc2a87cbd9","observation_id":"0e792a62-88eb-4830-8cc7-83f53491ac56","resolution":{"observed_at":"2026-08-05T13:54:43.925886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:43.716273Z","title":"Breast cancer wisconsin (diagnostic),","venue":null,"work_id":"3fce611b-b8fd-4186-bd93-f5213e4e0183","year":1993},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.352689Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:5722782c0b2c6e8c10aeb761128003a172ee8cb7f5d2f5c76f34e50cd88709a7","observation_id":"7801ff5b-3f05-4d26-8995-d3cf7e2a814c","resolution":{"observed_at":"2026-08-05T13:54:43.777193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:43.571676Z","title":"Using the adap learning algorithm to forecast the onset of diabetes mellitus,","venue":null,"work_id":"6c66adca-5ea6-4167-a6f7-2c80d7d8253f","year":1988},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.439728Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:bc345d943a5b30f53e89818ca1082288f9a99457f22d23cd46de95c789a740cd","observation_id":"1e07b7b6-48be-4400-970d-ab7e79800402","resolution":{"observed_at":"2026-08-05T13:54:43.634921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:43.401861Z","title":"Classification of radar returns from the ionosphere using neural networks,","venue":null,"work_id":"d3840d64-7988-41ed-92c4-29084a1481f6","year":1989},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.527626Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:9838b929c3cc67d43b03d8afac5f8f63411a94806cfc54a7c2946c9c5d7f4a51","observation_id":"0e0bb75e-e000-4dec-a12d-ec29eaac6aae","resolution":{"observed_at":"2026-08-05T13:54:43.485816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:43.221599Z","title":"Aeberhard and M","venue":null,"work_id":"a1732181-f1d1-4872-b14d-9e406a2c36c5","year":1992},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.589226Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:a55e711f5f4e79c878620972d0a89703fd1e9866c461f6b3787544a19a161b8d","observation_id":"a7a056a5-157b-4ce6-b695-bfc30dad2f4d","resolution":{"observed_at":"2026-08-05T13:54:43.297316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:43.083584Z","title":"Least angle regression,","venue":null,"work_id":"78cfe2bb-bc28-4f2b-ac66-c5f6ace97c82","year":2004},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.655542Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:62ac1e3927c092566eaac5d2c141f9bb6db0726a01afd263c142d7068d4b8383","observation_id":"f78070c5-967c-4984-9d5e-a22021ad85dc","resolution":{"observed_at":"2026-08-05T13:54:43.135410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T13:54:36.660090Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2509.00362."}