{"as_of":"2026-08-15T23:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ecb58682e75771ca5f206f8790a5ec4917c7712ebfa4db6bc27c4139cab18b83","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:54:42.655542Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.00362/citation-record","integrity":"/paper/2509.00362/integrity","json":"/paper/2509.00362/citation-record.json","paper":"/paper/2509.00362"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2106.10165","last_updated":"2021-08-24T17:12:56Z","snapshot_observed_at":"2026-08-14T00:12:50.096852Z","submitted_at":"2021-06-18T15:00:00Z","title":"The Principles of Deep Learning Theory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.10165","snapshot_observed_at":"2026-08-05T13:54:38.337984Z","title":"Hanin, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:38.337984Z"},"links":{"cited_paper":"/paper/2106.10165","citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:98623b81b88d9937a6225716eb8a917e45ad02692596f38de18eb431fc53eb09","observation_id":"e4aa0bc7-9e5a-44d7-9138-4ab5b4f3b988","resolution":{"observed_at":"2026-08-05T13:54:38.337984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:49.560144Z","title":"Goodfellow, Y","venue":null,"work_id":"d2de763e-9fc2-4838-a455-9ab87f14bccb","year":2016},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:38.435727Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:7b278e5df54cc33b4ab9a1591590f4a9477f5a13c6aa57d56da8d540f1e0eb06","observation_id":"eb3e46d1-ddea-4f89-9962-93a51c5bdf49","resolution":{"observed_at":"2026-08-05T13:54:49.641890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:49.373011Z","title":"Learning deep architectures for ai,","venue":null,"work_id":"bcf4f416-b800-482c-866b-9b3572e86a16","year":2009},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:38.508333Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:95eba6c37ceab501175b719e734962fdfd09630d6df52e4087c42efa58ced127","observation_id":"545a1f57-a38d-41a6-b8d0-96025c70060f","resolution":{"observed_at":"2026-08-05T13:54:49.426227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:38.585150Z","title":"Deep learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:38.585150Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:1a11409fb8a0100366beb99454620875567e0a25472883916123949a93b0a53e","observation_id":"16eb901e-4d48-473d-8263-e25e8ad01293","resolution":{"observed_at":"2026-08-05T13:54:38.585150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:38.661587Z","title":"Understanding the difficulty of training deep feedforward neural networks,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:38.661587Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:e44157900134fb1364ad16af08a6fee617ee5fa69d325ae0b5fc408ffcfc6886","observation_id":"b8556232-9b0e-4d06-80ad-567df169b552","resolution":{"observed_at":"2026-08-05T13:54:38.661587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:49.112336Z","title":"Rectified linear units improve restricted boltzmann machines,","venue":null,"work_id":"58434895-afac-4688-8f40-3682c7183205","year":2010},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:38.782904Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:1705556711ce17904c7349e24dc610321c9632a3771cc29dc121ffea0e914e3b","observation_id":"3db7f36d-6171-40f3-b94b-70dec21a8216","resolution":{"observed_at":"2026-08-05T13:54:49.217684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:48.963193Z","title":"Rectifier nonlinearities improve neural network acoustic models,","venue":null,"work_id":"90dabbc3-cac3-4eec-a15e-a4975221aafd","year":2013},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:38.892289Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:0d801d2eb5fb7c7a6fd970612786aa946b3bd8075ef4fa981a12c6e4a21f58a4","observation_id":"96b7fce7-9f10-4413-81d7-84976f8f4933","resolution":{"observed_at":"2026-08-05T13:54:49.017961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:39.009593Z","title":"Delving deep into rectifiers: Surpassing human-level performance on imagenet classification,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.009593Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:b3b7cadb93d53b859a8d951a765803bc63559e5922af912f677f8d70b4282378","observation_id":"0f294dad-f83a-437c-b11b-1adace5a5f99","resolution":{"observed_at":"2026-08-05T13:54:39.009593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.07289","last_updated":"2016-02-22T07:02:58Z","snapshot_observed_at":"2026-08-14T22:21:43.095256Z","submitted_at":"2015-11-23T15:58:05Z","title":"Fast and Accurate Deep Network Learning by Exponential Linear Units (ELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.07289","snapshot_observed_at":"2026-08-05T13:54:39.091827Z","title":"Fast and accurate deep network learning by exponential linear units (elus),","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.091827Z"},"links":{"cited_paper":"/paper/1511.07289","citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:19ed43aeabddc61389311de4bf10ade778bf47fce92d755f7f11330e8ee77a65","observation_id":"6c00c4bd-60ce-459d-b28d-b17ffef4afea","resolution":{"observed_at":"2026-08-05T13:54:39.091827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:39.196225Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.196225Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:a97dbd4076df57a9ef592f5a5b6735fcf2da21be09df391f44e980fbb0cab3f5","observation_id":"37c2f40e-c271-4a72-ad5a-c3bd5279d82d","resolution":{"observed_at":"2026-08-05T13:54:39.196225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:48.737232Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift,","venue":null,"work_id":"b7c1797a-161f-4a60-89ba-64ec2c77ace6","year":2015},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.299662Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:77a40d9f27dc53b2272b6fa3b250db4f72fffb245a24389b83294890728bf49c","observation_id":"a749d5d2-567e-4753-a16c-7454e20071af","resolution":{"observed_at":"2026-08-05T13:54:48.831261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:48.472806Z","title":"Resurrecting the sigmoid in deep learning through dynamical isometry: theory and practice,","venue":null,"work_id":"c78b629e-e1dd-4dd2-9bfc-28c97aa2cfef","year":2017},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.396828Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:013018904c7b2d0e661142d65b02fbd2c3e7a765082b2a1683daa85990360500","observation_id":"e7664735-e697-4e83-b4d2-36e3bfc4b706","resolution":{"observed_at":"2026-08-05T13:54:48.602039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6120","last_updated":"2014-02-19T17:26:57Z","snapshot_observed_at":"2026-08-14T23:50:45.351114Z","submitted_at":"2013-12-20T20:24:00Z","title":"Exact solutions to the nonlinear dynamics of learning in deep linear neural networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6120","snapshot_observed_at":"2026-08-05T13:54:39.504363Z","title":"Exact solutions to the nonlinear dynamics of learning in deep linear neural networks,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.504363Z"},"links":{"cited_paper":"/paper/1312.6120","citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:157ac99c3a0cb5628db2bf0d9c200bf9e870b31b546ff5ccd05b616523105941","observation_id":"2e7de407-4a55-4d88-8128-f98ce33ada94","resolution":{"observed_at":"2026-08-05T13:54:39.504363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:48.303702Z","title":"Improved weight initialization for deep and narrow feedforward neural network,","venue":null,"work_id":"4eea0d00-a118-41ab-8431-4d443a878802","year":2024},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.605430Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:ddb68238a605da12d69b57ea3ec773ce81588a5a37ce4c6f4eba310d674a2eac","observation_id":"8df18806-8dee-476a-9ef4-37536b392467","resolution":{"observed_at":"2026-08-05T13:54:48.391769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:39.698745Z","title":"Gradient-based learning applied to document recognition,","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.698745Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:cc96b051ab217416bae2680225c9ce2795809ba2afb7a98d8cf4b837a6cc6e81","observation_id":"9852b251-9cd6-4f0e-b23e-fd64527a498a","resolution":{"observed_at":"2026-08-05T13:54:39.698745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:48.059549Z","title":"Greedy layer-wise training of deep networks,","venue":null,"work_id":"ace5bc4c-21fd-498e-ad3c-2a58031cc037","year":2006},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.818237Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:4b52d2ca6abb6520e36e849b64176d4477060d4aeed964f05b07a77a66579d37","observation_id":"9bbafe7b-d449-4fe0-9bd1-b669fd9c39f4","resolution":{"observed_at":"2026-08-05T13:54:48.159720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:47.879208Z","title":"Learning repre- sentations by back-propagating errors,","venue":null,"work_id":"c5cb36a8-aca9-49d0-a237-3b7283b6ea2a","year":1986},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:39.931751Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:e39c32107250c69a43564502500ff226d88470d3a505d5a21847298bd1ddf3dd","observation_id":"b29e9942-9c55-4277-9433-e902fc8a8590","resolution":{"observed_at":"2026-08-05T13:54:47.969909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:47.627213Z","title":"Backpropagation applied to handwritten zip code recognition,","venue":null,"work_id":"82255bf6-6542-45d6-9acb-60fbdf0ca0a1","year":1989},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.019956Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:e2734bffbcec9c34271ab95164bd2584e99276224185f1b48ad910da8f687957","observation_id":"47b2b7fb-4ce4-4127-8047-007a5efe0f00","resolution":{"observed_at":"2026-08-05T13:54:47.753489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.06733","last_updated":"2020-10-21T19:19:02Z","snapshot_observed_at":"2026-08-14T17:01:32.909648Z","submitted_at":"2019-03-15T18:23:55Z","title":"Dying ReLU and Initialization: Theory and Numerical Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.06733","snapshot_observed_at":"2026-08-05T13:54:40.117887Z","title":"Dying relu and initializa- tion: Theory and numerical examples,","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.117887Z"},"links":{"cited_paper":"/paper/1903.06733","citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:fc2bf0582f0cdbd4ff297aebc7ec7c7083487412f3df77102033a0f73c3afd1e","observation_id":"df1e04ef-e002-4421-b7b4-dc71ddd32eed","resolution":{"observed_at":"2026-08-05T13:54:40.117887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:47.401140Z","title":"Robust weight initialization for tanh neural networks with fixed point analysis,","venue":null,"work_id":"3f11fc44-8810-4cde-aaaa-6dafe55d72d6","year":2025},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.220346Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:0dd1616ca96b8fc840e04c80cfa85d082bfa9860b06f3a09e1b40a2af5aa4412","observation_id":"fb25dd60-b402-40b0-9342-c3bd2767945f","resolution":{"observed_at":"2026-08-05T13:54:47.505430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:47.134695Z","title":"Revisiting weight initialization of deep neural networks,","venue":null,"work_id":"3aaed8a2-e33a-4d40-9140-b9c698d89938","year":2021},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.299763Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:63dbed61109119145bfbce129d99adab3efd5a8a235406c059e3ba102718b250","observation_id":"992c3cc1-1e2b-42b5-bdb6-65452b67badb","resolution":{"observed_at":"2026-08-05T13:54:47.253192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:46.804687Z","title":"Provable benefit of orthogonal initialization in optimizing deep linearnetworks,","venue":null,"work_id":"eeeb49e5-f9a9-403a-96ea-6eedb58c1160","year":2020},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.407624Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:789f7a93a8b1ac46c6e4af61cf6cd8ee8c3ffa0c850c0cd94de3fc1545dc1140","observation_id":"49db1ae4-ae3d-43b0-89d1-d8fcabd6e020","resolution":{"observed_at":"2026-08-05T13:54:46.926542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.03426","last_updated":"2020-09-18T01:56:41Z","snapshot_observed_at":"2026-08-02T15:32:07.466568Z","submitted_at":"2018-02-09T19:39:33Z","title":"UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.03426","snapshot_observed_at":"2026-08-05T13:54:40.453364Z","title":"Umap: Uniform manifold approximation and projection for dimension reduction,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.453364Z"},"links":{"cited_paper":"/paper/1802.03426","citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:2840e307d411f13dd87545737066f5bbffbf95588b82e9aef383ef3f65e5638e","observation_id":"68f188dd-950c-4bd2-8db3-36e116f81b6a","resolution":{"observed_at":"2026-08-05T13:54:40.453364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:46.556129Z","title":"Computational optimal transport: With applications to data science,","venue":null,"work_id":"af37d065-2547-4319-a041-91c0cdb20270","year":2019},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.550669Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:d283e377b823d8d74ff7020482a68b6b948c2347b0fbb4d60044b93388be290a","observation_id":"b0a7a0b3-39f4-4558-9391-5cdde1e52974","resolution":{"observed_at":"2026-08-05T13:54:46.681510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:40.640379Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.640379Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:c989b5f7019e4dfa7b0850a5726dec4e643d5cfd8f0324301bd832fbb50a2879","observation_id":"50e763ff-8fe3-409a-92da-b9981251a4de","resolution":{"observed_at":"2026-08-05T13:54:40.640379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"math-ph/0609050","last_updated":"2007-02-27T14:22:05Z","snapshot_observed_at":"2026-08-15T11:03:08.882780Z","submitted_at":"2006-09-18T11:18:42Z","title":"How to generate random matrices from the classical compact groups","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"math-ph/0609050","snapshot_observed_at":"2026-08-05T13:54:40.704791Z","title":"How to generate random matrices from the classical compact groups,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.704791Z"},"links":{"cited_paper":"/paper/math-ph/0609050","citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:99b9f1fa98ad39677e37a4ef9c39aa5d7fdd436586ea7952f79bce3765915afd","observation_id":"c62ef329-0ff5-43a1-aff2-fc0471f683c9","resolution":{"observed_at":"2026-08-05T13:54:40.704791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:46.236602Z","title":null,"venue":null,"work_id":"d93863ef-372a-4bb1-8526-75007503a01a","year":2002},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.812459Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:6be3a0469939cb4820d1ae4dbc959a52e50fbf6c2302199361efdadc9cf08612","observation_id":"3340867c-22c0-46f0-8f1a-86f103cf3e93","resolution":{"observed_at":"2026-08-05T13:54:46.362403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:45.965855Z","title":"Mean field residual networks: On the edge of chaos,","venue":null,"work_id":"ea0b7a49-11b1-4e9f-b48b-6e6d5e882f5d","year":2017},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:40.891169Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:588f6e9fde5a441ffe28c5f40e1ff6e7796ddef642f8bac23617adb53afa1e90","observation_id":"63fdffbe-224f-444b-8031-9f209299d1e6","resolution":{"observed_at":"2026-08-05T13:54:46.065471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:45.707387Z","title":"Skewness and kurtosis in real data samples,","venue":null,"work_id":"26ee111a-5c94-4cf7-84cb-ff2f9d2a41ab","year":2013},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.000472Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:c579392759950d9ebc350a23c911cf126bbbdd3b9e649e68c6472a69064fe7bc","observation_id":"f07fb28b-ef17-4a94-b81b-c6be7d2c9732","resolution":{"observed_at":"2026-08-05T13:54:45.831819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:45.506913Z","title":"Transforming variables to central normality,","venue":null,"work_id":"4633bac3-7467-40d0-9b4b-ed122f0e6111","year":2024},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.099749Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:514210912a318e9d6d8364ab69248ed37273659c76b3e71032529b82248fc65f","observation_id":"5be93ecb-e2e5-4784-a979-cfb714cabfb8","resolution":{"observed_at":"2026-08-05T13:54:45.585323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:45.335626Z","title":"A comparison principle for functions of a uniformly random subspace,","venue":null,"work_id":"0cfdfb8e-21ec-4bf4-baa4-ec6c79b0b79b","year":2012},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.243232Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:958313231e2ef6f5dae578e7a74aa960569c2f0364e4578541b2e8e3fe82b7bd","observation_id":"a9ce912d-6ebd-4f40-b737-63349f450ebb","resolution":{"observed_at":"2026-08-05T13:54:45.417588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:45.194284Z","title":"Maxima of entries of haar distributed matrices,","venue":null,"work_id":"ade7ec2d-4820-4a08-b6bb-670c15ea2445","year":2005},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.367869Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:83cb2b0ee3d4fae788e24b2991998e94c9781e3da71e398927107c74222f18e3","observation_id":"2cc4855d-b4ac-497a-b5d4-03e4c6d9b4c2","resolution":{"observed_at":"2026-08-05T13:54:45.266258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:45.053823Z","title":"A multivariate berry–esseen theorem with explicit constants,","venue":null,"work_id":"2dc23d14-60d5-4ad6-9808-831922dd06d5","year":2019},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.474512Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:5c6e73d646e5f61cf5332807009b877b6f74cd431fdaaca4e0da9873496e0e88","observation_id":"b748df7b-a0bb-4c10-a1fd-4537dc5f68a4","resolution":{"observed_at":"2026-08-05T13:54:45.125585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:44.881412Z","title":null,"venue":null,"work_id":"dd245924-1c2e-416a-b6f5-2fdc8f69f97f","year":2000},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.609288Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:84856c26d71a7914009c07ef0a9004c49e19a714db3c1453a7dac1baaf89d5d8","observation_id":"22ea0ccd-1623-411c-aa17-71f71db790c6","resolution":{"observed_at":"2026-08-05T13:54:44.954032Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01232","last_updated":"2017-04-04T19:36:14Z","snapshot_observed_at":"2026-08-14T21:32:01.686705Z","submitted_at":"2016-11-04T00:44:32Z","title":"Deep Information Propagation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01232","snapshot_observed_at":"2026-08-05T13:54:41.698132Z","title":"Deep information propagation,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.698132Z"},"links":{"cited_paper":"/paper/1611.01232","citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:f33c1e3fbcfcddd51b1736bab283aecffa8633a4194afe50787ed78d81c1953a","observation_id":"b09b980d-6478-4ff2-b8c9-3f232b86d2ac","resolution":{"observed_at":"2026-08-05T13:54:41.698132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:44.732541Z","title":"On numerical computation for the distribution of the convolution of N independent rectified Gaussian variables,","venue":null,"work_id":"2475aa9b-0b41-438a-9ff2-549da5af4851","year":2018},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.830597Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:067f92c17a52ebf706c97b7c77ac3927fdeac904e8c2055d43fe49466e7e083e","observation_id":"d73c2608-812b-4481-a942-17f09ada5173","resolution":{"observed_at":"2026-08-05T13:54:44.809342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:44.555003Z","title":"An analytic solution to covariance propagation in neural networks,","venue":null,"work_id":"8914efab-9415-4d0e-b14b-73acf5fc311d","year":2024},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:41.929977Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:8a0941bf4e87baabbd91aba121374fa26f4ab334a25e0520a2879cd0784fd56a","observation_id":"89cc8e28-2522-4a55-be14-290b9ce4385f","resolution":{"observed_at":"2026-08-05T13:54:44.638529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:44.372216Z","title":"How to start training: The effect of initialization and architecture,","venue":null,"work_id":"d5c713a7-6a77-4d72-99ff-8dd0891fa212","year":2018},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.038297Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:6f649f6c532de94e740615f4bb73f15c5d3c19f8f000c8d254d7ed49e90bce40","observation_id":"f4f919c9-1bd7-4544-8042-9b6d310462b5","resolution":{"observed_at":"2026-08-05T13:54:44.478154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:44.197874Z","title":"Tensor programs VI: Feature learning in infinite depth neural networks,","venue":null,"work_id":"dd70cd33-d77e-465b-ae5e-6d175c70b83d","year":2024},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.108317Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:be7538e7009b703cdb2821d6a811b9a3bbe0fa740219aef507a53ecb7f82d7f2","observation_id":"5dc06971-54f9-4f6b-aae9-77d7cf93878f","resolution":{"observed_at":"2026-08-05T13:54:44.300378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:44.030716Z","title":"Self- normalizing neural networks,","venue":null,"work_id":"96b4b7e4-addc-4050-83fc-c7c3ba19cb2f","year":2017},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.192754Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:8c514b20a4b9831cffa453cf4a07836ae440dabd484daafd2f8d35608a889581","observation_id":"ea2258ea-e22e-46d4-9b71-3840855cdd06","resolution":{"observed_at":"2026-08-05T13:54:44.090831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:43.856153Z","title":"Becker and R","venue":null,"work_id":"51a39532-391f-4e51-866c-2c274cd4bfca","year":1996},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.254056Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:8d59e7ef8b2f812b6f6e9b26ce0acd63a2bdc3754a00ac1924c5f044d32eecb9","observation_id":"0e792a62-88eb-4830-8cc7-83f53491ac56","resolution":{"observed_at":"2026-08-05T13:54:43.925886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:43.716273Z","title":"Breast cancer wisconsin (diagnostic),","venue":null,"work_id":"3fce611b-b8fd-4186-bd93-f5213e4e0183","year":1993},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.352689Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:78153ab73dc278558bc94462288313b56c0321bb13e7d90363fe15be7b801db5","observation_id":"7801ff5b-3f05-4d26-8995-d3cf7e2a814c","resolution":{"observed_at":"2026-08-05T13:54:43.777193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:43.571676Z","title":"Using the adap learning algorithm to forecast the onset of diabetes mellitus,","venue":null,"work_id":"6c66adca-5ea6-4167-a6f7-2c80d7d8253f","year":1988},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.439728Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:62104e87c87c83b787962d01e9e56fabb47dede01862d34a5ac6dd6f1281b249","observation_id":"1e07b7b6-48be-4400-970d-ab7e79800402","resolution":{"observed_at":"2026-08-05T13:54:43.634921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:43.401861Z","title":"Classification of radar returns from the ionosphere using neural networks,","venue":null,"work_id":"d3840d64-7988-41ed-92c4-29084a1481f6","year":1989},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.527626Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:6d1cbf1aa3033df19b9d4a958721d7a3bf19032f144e327e4ae432da377763c6","observation_id":"0e0bb75e-e000-4dec-a12d-ec29eaac6aae","resolution":{"observed_at":"2026-08-05T13:54:43.485816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:43.221599Z","title":"Aeberhard and M","venue":null,"work_id":"a1732181-f1d1-4872-b14d-9e406a2c36c5","year":1992},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.589226Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:3973cd449c95f7bb2479b246912dd7821baa2bfcc97690211318df210514ab1f","observation_id":"a7a056a5-157b-4ce6-b695-bfc30dad2f4d","resolution":{"observed_at":"2026-08-05T13:54:43.297316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:54:43.083584Z","title":"Least angle regression,","venue":null,"work_id":"78cfe2bb-bc28-4f2b-ac66-c5f6ace97c82","year":2004},"citing_paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T13:54:42.655542Z"},"links":{"citing_paper":"/paper/2509.00362"},"observation_digest":"sha256:7fda3cd8a804c93656be25ed07946a871ec2aa9ef2002eb1ecb17a38b58d8c19","observation_id":"f78070c5-967c-4984-9d5e-a22021ad85dc","resolution":{"observed_at":"2026-08-05T13:54:43.135410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.00362","last_updated":"2025-08-30T05:17:31Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T12:20:32.464718Z","submitted_at":"2025-08-30T05:17:31Z","title":"Optimized Weight Initialization on the Stiefel Manifold for Deep ReLU Neural Networks"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2509.00362."}