{"as_of":"2026-08-09T09:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fe6ce661084fd0712cebc2ae4ad266934411bfb8b2aca77946a9db64dcef1341","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T21:38:27.419250Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.19799/citation-record","integrity":"/paper/2602.19799/integrity","json":"/paper/2602.19799/citation-record.json","paper":"/paper/2602.19799"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:21.694139Z","title":"Natural gradient works efficiently in learning","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:21.694139Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:0f90afed551771515bdeed8f810d13c0c0e9a9d0265e9fce6de3804c9dab363a","observation_id":"c6501f07-4b57-4279-9f26-e8385a2500dd","resolution":{"observed_at":"2026-08-02T21:38:21.694139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:21.820820Z","title":"Neural teleportation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:21.820820Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:ec26addaf6105dd67daa6ade57f3438c6426ce74abab9f62f9441dfd7ce336a0","observation_id":"2ef0a38c-9ca0-423a-9f4a-2b1d57c93518","resolution":{"observed_at":"2026-08-02T21:38:21.820820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:21.970510Z","title":"Fine-grained analysis of optimization and generalization for overparameterized two-layer neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:21.970510Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:fa8f9b759893c72d67c101821e6274e70045b1793f04dd6b680394d8d2f1f753","observation_id":"184e502b-a156-49ee-8756-f16e5b85f9fb","resolution":{"observed_at":"2026-08-02T21:38:21.970510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:22.132979Z","title":"S., Woodworth, B","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:22.132979Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:bb2681bb533b08d1cd7e452b0416d6201526cf7eb60ddd1cfcec84fb727d440b","observation_id":"fd9546f1-b148-4747-9403-67d36ef3a28a","resolution":{"observed_at":"2026-08-02T21:38:22.132979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.01754","last_updated":"2015-11-07T19:01:03Z","snapshot_observed_at":"2026-08-06T21:25:37.715749Z","submitted_at":"2015-11-05T14:17:40Z","title":"Symmetry-invariant optimization in deep networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.01754","snapshot_observed_at":"2026-08-02T21:38:22.267499Z","title":"Symmetry-invariant optimization in deep networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:22.267499Z"},"links":{"cited_paper":"/paper/1511.01754","citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:a551bfae2cd40c8b87175f76987d5cb4e9845924c78d8fe3c47070b187268d4b","observation_id":"4db07ae7-76b8-47fc-8fb6-361ae923dd5e","resolution":{"observed_at":"2026-08-02T21:38:22.267499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:22.383424Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:22.383424Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:8d828f41b57116acb1f640e387cc991aa3440f6a685164917b0c11d0e2ba3ab3","observation_id":"a066434d-b07e-4dde-b904-7080d582de6c","resolution":{"observed_at":"2026-08-02T21:38:22.383424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:22.582057Z","title":"Local identifiability of deep relu neural networks: the theory","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:22.582057Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:f15a40918ce6f1d6fab6e100ecc6a749cf60fcce311df82cd44c41148c94fdf4","observation_id":"840b099b-d78c-4772-933e-73e39dcc69df","resolution":{"observed_at":"2026-08-02T21:38:22.582057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:22.735455Z","title":"A brief introduction to the neural tangent kernel","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:22.735455Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:1100507423f45311e982fc28976cc15a9b3a2f6fba175a7a5a7620356871d584","observation_id":"0a206a25-45dd-42a9-a386-c59a8bc2d3ad","resolution":{"observed_at":"2026-08-02T21:38:22.735455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:22.822414Z","title":"On lazy training in differentiable programming","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:22.822414Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:bcb85f302ed2f69bc92da9abcfee7ba4668328fec8d9be62a48ba711cf63a8df","observation_id":"7784c279-3e43-4575-b7c0-480003e447d2","resolution":{"observed_at":"2026-08-02T21:38:22.822414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:22.915466Z","title":"H., Leiserson, C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:22.915466Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:6cd6c48746abfc4069872c1e0b62ea031a05de9e6e31f048475c6bb7a706d633","observation_id":"e5e8c712-521d-4e0a-9fc7-0711cc09839f","resolution":{"observed_at":"2026-08-02T21:38:22.915466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:23.047270Z","title":"Natural neural networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:23.047270Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:3e5fdac876dc69fd6c58041c85d635e08731cf70def083b4aea3f1231335a72c","observation_id":"b9dbf63c-322e-44b5-bae2-c3d1c5af1175","resolution":{"observed_at":"2026-08-02T21:38:23.047270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:23.161192Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:23.161192Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:96279c03b100af8c58ec92fbb6ebc9123227009f406dd2b45cf5e39d69724774","observation_id":"60f71656-895e-42d7-83cc-8b7346f12f69","resolution":{"observed_at":"2026-08-02T21:38:23.161192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:23.265591Z","title":"Sharp minima can generalize for deep nets","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:23.265591Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:80f4de94c873db4e59935359a1823fb57ac146222e4267621c9062810233b2f5","observation_id":"f6475d62-7664-4032-8c6a-322e84020292","resolution":{"observed_at":"2026-08-02T21:38:23.265591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:23.393249Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:23.393249Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:46e07f228b411454a056a5a2bf2005338fee967f5aa6566e45be48437390ba6e","observation_id":"d45aa755-466e-4753-9cee-9bbca462965f","resolution":{"observed_at":"2026-08-02T21:38:23.393249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:23.515980Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:23.515980Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:966c36c9fcd2a029151f5bc1e02ca5c7840a9f9ca1961db9f8bdf540d32487d7","observation_id":"60dc4d7f-80f9-49a3-b05a-22a2ce4369d3","resolution":{"observed_at":"2026-08-02T21:38:23.515980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:23.670179Z","title":"S., Hu, W., and Lee, J","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:23.670179Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:abe2c55334440dbc4adda1b47c8904f04af81ed31ee9152c61d37309a3052593","observation_id":"acd58375-9907-41e7-bc4e-f03735850add","resolution":{"observed_at":"2026-08-02T21:38:23.670179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.00805","last_updated":"2018-08-21T00:02:44Z","snapshot_observed_at":"2026-07-06T05:36:24.195368Z","submitted_at":"2017-04-03T20:50:29Z","title":"On the Properties of the Softmax Function with Application in Game Theory and Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.00805","snapshot_observed_at":"2026-08-02T21:38:23.768842Z","title":"and Pavel, L","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:23.768842Z"},"links":{"cited_paper":"/paper/1704.00805","citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:89489bf004f130886ff3473f47be536773c78540af8e3c7b714d8a5aea1a079f","observation_id":"85ead63b-f6d1-4e19-ad76-e4f633411b7b","resolution":{"observed_at":"2026-08-02T21:38:23.768842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.10552","last_updated":"2021-01-26T04:29:50Z","snapshot_observed_at":"2026-08-03T21:08:07.576974Z","submitted_at":"2021-01-26T04:29:50Z","title":"A Unified Paths Perspective for Pruning at Initialization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.10552","snapshot_observed_at":"2026-08-02T21:38:23.837181Z","title":"A unified paths perspective for pruning at initialization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:23.837181Z"},"links":{"cited_paper":"/paper/2101.10552","citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:1e76367fb1cc6758597d95c8d037a44d05cc93cf0d1ee04af548c5d6288bf0bd","observation_id":"b91a2422-c953-4799-be04-e716e5453a59","resolution":{"observed_at":"2026-08-02T21:38:23.837181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1709.08145","last_updated":"2017-10-07T23:28:57Z","snapshot_observed_at":"2026-08-09T06:09:35.752670Z","submitted_at":"2017-09-24T04:33:53Z","title":"Comparison of Batch Normalization and Weight Normalization Algorithms for the Large-scale Image Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.08145","snapshot_observed_at":"2026-08-02T21:38:23.953389Z","title":"and Ginsburg, B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:23.953389Z"},"links":{"cited_paper":"/paper/1709.08145","citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:a7af24954ea0361ceaaea72434bc00e99d278a2a0327806bd7ff3cf38597f126","observation_id":"cb7c745d-0b1e-40d8-b08d-0c640b9194b1","resolution":{"observed_at":"2026-08-02T21:38:23.953389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:24.044942Z","title":"and Bengio, Y","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:24.044942Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:74ae3abf2a84960cd538a5c80a7295409a04cd7676e16e1f8a4ab4b5dca31178","observation_id":"726401bb-de62-4186-b424-5a264e914142","resolution":{"observed_at":"2026-08-02T21:38:24.044942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:24.176360Z","title":"Harnessing symmetries for modern deep learning challenges: a path-lifting perspective","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:24.176360Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:a6ca54a2e88e067e437b5c52703019002fa340b59de527258251df5907128fa2","observation_id":"f1e2f5fa-5b39-424f-9f50-a477745d993a","resolution":{"observed_at":"2026-08-02T21:38:24.176360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01225","last_updated":"2024-12-04T10:04:02Z","snapshot_observed_at":"2026-08-02T22:32:10.994977Z","submitted_at":"2023-10-02T14:12:53Z","title":"A path-norm toolkit for modern networks: consequences, promises and challenges","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01225","snapshot_observed_at":"2026-08-02T21:38:24.338231Z","title":"A path-norm toolkit for modern networks: consequences, promises and challenges","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:24.338231Z"},"links":{"cited_paper":"/paper/2310.01225","citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:174f2af1b21f6839ac5b8b0884ec0bc5bd9b1f512a17fd9ee01f893ba4515d7f","observation_id":"c449e2f4-7e10-4349-a1a3-c7e61857bba7","resolution":{"observed_at":"2026-08-02T21:38:24.338231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:24.511667Z","title":"Characterizing implicit bias in terms of optimization geometry","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:24.511667Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:f1479b70e4ef6711608fddf918997945c4ee4206eb550526d0ba9d554ac7c30b","observation_id":"45020cab-8944-4357-af1e-b9c36369885b","resolution":{"observed_at":"2026-08-02T21:38:24.511667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:24.635627Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:24.635627Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:8496f0fc1381eee0a4274916b2b35f2ed3e6a097b7b39cc936ea41a553d06e0c","observation_id":"03647546-1afa-4ed0-82d5-f4c7905589e3","resolution":{"observed_at":"2026-08-02T21:38:24.635627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:24.773115Z","title":"Delving deep into rectifiers: Surpassing human-level performance on imagenet classification","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:24.773115Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:c11f9274dfce93d69011c9a026bbab221d5fbb7d222c08889b13a9dbd4a96f2e","observation_id":"dc4a8d7b-5999-4550-a905-e793569c0c81","resolution":{"observed_at":"2026-08-02T21:38:24.773115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:24.839502Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:24.839502Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:841ed87ac06dd540a59b77c66e8c1201f892b525c0df0a1c64f6f35a9844f012","observation_id":"f77a273b-fbdb-49ea-8966-38d1e10db0a1","resolution":{"observed_at":"2026-08-02T21:38:24.839502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04861","last_updated":"2017-04-17T03:57:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-04-17T03:57:34Z","title":"MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04861","snapshot_observed_at":"2026-08-02T21:38:25.004763Z","title":"G., Zhu, M., Chen, B., Kalenichenko, D., Wang, W., Weyand, T., Andreetto, M., and Adam, H","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:25.004763Z"},"links":{"cited_paper":"/paper/1704.04861","citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:eb1a59be309b38744c09fae811ba21beb7c51c153ce70176891f27f3713952d7","observation_id":"3d72324c-5fc1-4515-a838-12ca11be9322","resolution":{"observed_at":"2026-08-02T21:38:25.004763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:25.110386Z","title":"Neural tangent kernel: Convergence and generalization in neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:25.110386Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:2917be5277b87507306c4109b6db75c5da2520bfeda477882c17b20211f73ea8","observation_id":"5306cd09-96c7-49bd-8947-655b7f74319f","resolution":{"observed_at":"2026-08-02T21:38:25.110386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:25.233355Z","title":"Estimation with quadratic loss","venue":null,"work_id":null,"year":1961},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:25.233355Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:baa732f2e365c5bccf483f622fd735942fafc24a6a2a77e3dd89e8e92b076be2","observation_id":"f651d475-ca3e-487b-b0a8-63cc8597c526","resolution":{"observed_at":"2026-08-02T21:38:25.233355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:25.301569Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:25.301569Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:724aaf6b282ad53495fc83a129b7456df21cdc3a4e110129d82a59f479debafe","observation_id":"e4824d3d-4d1d-4ec4-99b6-674ec4d5795d","resolution":{"observed_at":"2026-08-02T21:38:25.301569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:25.383948Z","title":"A., and Dhillon, I","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:25.383948Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:14ff66318f57600426817069e9c758658eee9b533bca3f5103847db84cb5b0ef","observation_id":"2c77ae1a-cd65-4efc-ba26-478efeb3d272","resolution":{"observed_at":"2026-08-02T21:38:25.383948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:25.483558Z","title":"L., and Tanaka, H","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:25.483558Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:6c8d163fdcd8ab4de71350ec271a68ee2c5d96c1052ce18d27961f2e467550c8","observation_id":"b4c42270-8d72-4dbc-aedf-9482c6a4f990","resolution":{"observed_at":"2026-08-02T21:38:25.483558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:25.580241Z","title":"Get rich quick: exact solutions reveal how unbalanced initializations promote rapid feature learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:25.580241Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:6e6c3a4c455510f4b12256b03f1032a246f06115f79033c7134d09db5960430b","observation_id":"3505a13c-aa93-41d6-af6c-ccac392cb268","resolution":{"observed_at":"2026-08-02T21:38:25.580241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:25.674243Z","title":"Abide by the law and follow the flow: Conservation laws for gradient flows","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:25.674243Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:1d43e18aebcac7cd377d4dfce95b928756247b58cc0d3f83aba7d04aa3c2a1e3","observation_id":"370e0c00-3411-416e-9137-276f902c2c51","resolution":{"observed_at":"2026-08-02T21:38:25.674243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:25.750320Z","title":"Intrinsic training dynamics of deep neural networks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:25.750320Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:f2df638542eb4b5ac78e4fb95368d03d70e5e03bbfd8d093dfce2c63ea03db81","observation_id":"ca9a616b-6dc9-450b-bd2c-86864133d66b","resolution":{"observed_at":"2026-08-02T21:38:25.750320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:25.847103Z","title":"New insights and perspectives on the natural gradient method","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:25.847103Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:451bdea20f242c17749f89dd2ed39496ea7355953ea16d74acb324c73c0257f0","observation_id":"fa2b0582-5f95-4b5f-876b-0f4c5c8c56a1","resolution":{"observed_at":"2026-08-02T21:38:25.847103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:25.978599Z","title":"G- SGD : Optimizing re LU neural networks in its positively scale-invariant space","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:25.978599Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:b9f73d773dd1a6fada531775a371c92bbe051498689b89bac9bb3760d2941729","observation_id":"6e506822-3758-4985-bdfe-77142625bf8f","resolution":{"observed_at":"2026-08-02T21:38:25.978599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:26.054855Z","title":"and Burkholz, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:26.054855Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:4f5100a45e507bad20cae5d6cb6c8653975592e6691fe1ceed41ca5f2f641ffd","observation_id":"c60f89dc-0f07-482d-b253-fc8c0675b83f","resolution":{"observed_at":"2026-08-02T21:38:26.054855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:26.134101Z","title":"R., and Srebro, N","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:26.134101Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:3eda80d8b74ada61f39f75203b908faf7ebb9d2ecee11a91b2c33c0afb28aaaf","observation_id":"618de956-b7af-4ef0-bf28-4cba48660482","resolution":{"observed_at":"2026-08-02T21:38:26.134101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:26.240684Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:26.240684Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:c09010b79c640d114995eceb66c192f77c83e822c8f3c57bcfa0207e8f0f621d","observation_id":"49e5dc7f-5839-4a2a-9856-1db1ec9f4e1d","resolution":{"observed_at":"2026-08-02T21:38:26.240684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:26.324433Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:26.324433Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:718496eee15082c6da40aa0a89de7cd6edb2dd550313efee50a3e8badc056a4e","observation_id":"55300025-c3f0-4f33-88d6-5b2f6431c8ba","resolution":{"observed_at":"2026-08-02T21:38:26.324433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:26.428948Z","title":"and Corvellec, M","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:26.428948Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:dbbea2a3d25b7433236634a2c69ef09e1d689f6de7ee2763d714685795cba7d4","observation_id":"627c721c-82db-4fb1-9610-bcb87f8130ec","resolution":{"observed_at":"2026-08-02T21:38:26.428948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08797","last_updated":"2024-02-13T21:10:21Z","snapshot_observed_at":"2026-08-03T16:18:50.717637Z","submitted_at":"2024-02-13T21:10:21Z","title":"Computing Power and the Governance of Artificial Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08797","snapshot_observed_at":"2026-08-02T21:38:26.492887Z","title":"K., Ngo, R., Pilz, K., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:26.492887Z"},"links":{"cited_paper":"/paper/2402.08797","citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:11609e84f9c7cf5270cdcd53f7924f5fff0688a809cd9a7ffa6c9ff945f1026a","observation_id":"b087e936-ca84-49b9-bcaa-9fa7b9ff3fbf","resolution":{"observed_at":"2026-08-02T21:38:26.492887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:26.582065Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:26.582065Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:7d039cfbce6091289872d996dcbf5806ae61ce8b6aec54b4fb33baf7ea2c846e","observation_id":"09ba9a9b-3c8a-40a4-88b9-e36d2b229c37","resolution":{"observed_at":"2026-08-02T21:38:26.582065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:26.680020Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:26.680020Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:f5c6205c04c118f36fe84af5bd244532c74e606191e2b5e2e3e0e14c429b7cad","observation_id":"19dfe298-c99b-4b3d-9e38-0a16f7a7bee9","resolution":{"observed_at":"2026-08-02T21:38:26.680020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:26.796022Z","title":"J., Guez, A., Sifre, L., Van Den Driessche, G., Schrittwieser, J., Antonoglou, I., Panneershelvam, V., Lanctot, M., et al","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:26.796022Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:59b45427d1135000c920b883f60a3c24343622f4911f2281583192549f9a036e","observation_id":"94bfc678-9e10-4edf-b5f6-76b6097f8f23","resolution":{"observed_at":"2026-08-02T21:38:26.796022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-02T21:38:26.921884Z","title":"and Zisserman, A","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:26.921884Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:740ca4f9b31c91b44bd832015b4533e9bb242c47e870421321ea238d3f1b4092","observation_id":"40e4488d-07d8-44ed-ad29-1b2ee4724475","resolution":{"observed_at":"2026-08-02T21:38:26.921884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:27.036217Z","title":"and Gribonval, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:27.036217Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:bc184a660d416d9083e13854a5e10c033046639e206aab3f61f2dbe3ff28cd32","observation_id":"85bab7d8-ced9-4ec5-a98d-053039d739ee","resolution":{"observed_at":"2026-08-02T21:38:27.036217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:27.117250Z","title":"Equi-normalization of neural networks, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:27.117250Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:13560a76bb3cdad28428c005715678449655c5b77f757409f992838e3287e73c","observation_id":"d20cc988-bf93-4193-961c-9090581c4f93","resolution":{"observed_at":"2026-08-02T21:38:27.117250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:27.176982Z","title":"Going deeper with convolutions","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:27.176982Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:165ca4240e0124966679751e88279ddff4519627658787f1b3cfc3b28ca5e75d","observation_id":"5e161e66-12a2-4460-b521-65c08aa50d67","resolution":{"observed_at":"2026-08-02T21:38:27.176982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:27.249328Z","title":"Growing tiny networks: Spotting expressivity bottlenecks and fixing them optimally","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:27.249328Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:665ed50c16263f7d15b3111380f72683f05504924e748c30a19aa5c80e522e95","observation_id":"4be5399e-53b4-462a-a98b-ac0d1381b190","resolution":{"observed_at":"2026-08-02T21:38:27.249328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:27.315521Z","title":"Thermodynamik quantenmechanischer gesamtheiten","venue":null,"work_id":null,"year":1927},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:27.315521Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:69fa44906d04cdbd4d17ce9fc245dd9451070f4e70f06c61b63bdfa35892e885","observation_id":"89a0a0f0-6c8e-4a49-bb5e-4668fcb962da","resolution":{"observed_at":"2026-08-02T21:38:27.315521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:27.381657Z","title":"Symmetry teleportation for accelerated optimization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:27.381657Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:edd9604ca2f6f29785e1891d24808ab8c484d6250257b9d0bf89c06074c6116b","observation_id":"6966831f-d5c6-4915-982b-09fce878dd71","resolution":{"observed_at":"2026-08-02T21:38:27.381657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:38:27.419250Z","title":"Symmetries, flat minima, and the conserved quantities of gradient flow","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-02T21:38:27.419250Z"},"links":{"citing_paper":"/paper/2602.19799"},"observation_digest":"sha256:8d6f70ef7fefbef0feed9fb54bd9daf800fe3fb254b9037f6e8548909392e905","observation_id":"7c9c8442-a459-4e32-ae80-3ab6f2f0cef3","resolution":{"observed_at":"2026-08-02T21:38:27.419250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.19799","last_updated":"2026-06-03T12:05:22Z","latest_version":2,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-07T18:09:01.779385Z","submitted_at":"2026-02-23T12:55:48Z","title":"Path-conditioned training: a principled way to rescale ReLU neural networks"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":54,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2602.19799."}