{"as_of":"2026-08-19T10:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:749ed3da37823636d3660575b5a64b983a6748641c272b09cef09a97d399c83e","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:43:14.326705Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-02T17:31:02.850791Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T17:37:13.925711Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"cited_work":{"arxiv_id":"2510.14074","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.14074","snapshot_observed_at":"2026-07-14T03:22:45.605646Z","title":"Exact dynamics of multi-class stochastic gradient descent, 2025","venue":null,"work_id":"3b592ade-c45b-48ff-bb5f-f13030748a5c","year":2025},"citing_paper":{"arxiv_id":"2607.00207","last_updated":"2026-06-30T21:38:10Z","snapshot_observed_at":"2026-08-16T16:23:45.380762Z","submitted_at":"2026-06-30T21:38:10Z","title":"Homogenization of $\\ell_2$-Adversarial Training in High-Dimensions: Exact Dynamics under Stochastic Gradient Descent","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-02T17:31:02.850791Z"},"links":{"cited_paper":"/paper/2510.14074","citing_paper":"/paper/2607.00207"},"observation_digest":"sha256:2a948802f6a30c33b7f6bc6098ff87f650e36b5e2d8a0cb799a41e6a6454660a","observation_id":"21607f55-cac6-4e44-b83d-2fe74efa4909","resolution":{"observed_at":"2026-07-14T03:22:45.605646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2510.14074/citation-record","integrity":"/paper/2510.14074/integrity","json":"/paper/2510.14074/citation-record.json","paper":"/paper/2510.14074"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:08.662758Z","title":"Escaping mediocrity: how two-layer networks learn hard single-index models with SGD.CoRR, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:08.662758Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:07e5340f3fb31fd19b96bd019d53f6c03f3efd1e044f41a14259485ca683c8ef","observation_id":"a07eb370-ec60-491e-956b-b025dfccb3b9","resolution":{"observed_at":"2026-08-04T09:43:08.662758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:08.759247Z","title":"From high-dimensional & mean-field dynamics to dimensionless ODEs: A unifying approach to SGD in two-layers networks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:08.759247Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:d39efc96919a2b92aacc81418d2fe6490b8b4a1259a9d75d1a0a7224049d0aa8","observation_id":"98e44c79-1ebd-4d77-b12c-2766efc8ece1","resolution":{"observed_at":"2026-08-04T09:43:08.759247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:08.934177Z","title":"Minimax theory for high-dimensional gaussian mixtures with sparse mean separation.Advances in Neural Information Processing Systems, 26, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:08.934177Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:36a4a003b5299f4a4ef3dfaa99221f60269c992d5d5bad0cf1c2faebcf6de675","observation_id":"72a2f395-59a8-4157-8cf2-12836040937b","resolution":{"observed_at":"2026-08-04T09:43:08.934177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00707","last_updated":"2024-04-03T18:44:32Z","snapshot_observed_at":"2026-08-16T15:43:20.776892Z","submitted_at":"2023-04-03T03:50:00Z","title":"High-dimensional scaling limits and fluctuations of online least-squares SGD with smooth covariance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.00707","snapshot_observed_at":"2026-08-04T09:43:09.084449Z","title":"High-dimensional scaling limits and fluctuations of online least-squares SGD with smooth covariance.arXiv preprint arXiv:2304.00707, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:09.084449Z"},"links":{"cited_paper":"/paper/2304.00707","citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:7f7c10d2256b1b891256c14c18b067d42bb8e8e407ee74be9592f22d000b3780","observation_id":"18c8ed93-829a-479d-85a1-07b97bd8be7c","resolution":{"observed_at":"2026-08-04T09:43:09.084449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:09.225286Z","title":"Spectrally-normalized margin bounds for neural networks.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:09.225286Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:f7cfcc0010e2f746c144314573d90d06f81c8ede8788dabe8ea71642f5b7dde2","observation_id":"0beadbd3-0bb5-49e5-9407-9e5cde07a855","resolution":{"observed_at":"2026-08-04T09:43:09.225286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:09.374734Z","title":"Local geometry of high-dimensional mixture models: Effective spectral theory and dynamical transitions.arXiv preprint arXiv:2502.15655, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:09.374734Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:d895ece22c152b6fbdb2ad29a5560e3e7e8141e542baeb20f404c83ce7c94265","observation_id":"2cdc4722-4599-4f3e-808f-a2b1b33ba480","resolution":{"observed_at":"2026-08-04T09:43:09.374734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:09.508327Z","title":"Online stochastic gradient descent on non- convex losses from high-dimensional inference.The Journal of Machine Learning Research, 22(1):4788– 4838, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:09.508327Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:b3d7779744791ba9e21bad525c7f0cfa0d3a6f31ee5c54ced230a6ac2997953d","observation_id":"d458c512-1236-46e6-ab75-f3dbefd2298e","resolution":{"observed_at":"2026-08-04T09:43:09.508327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:09.689739Z","title":"High-dimensional limit theorems for SGD: Effective dynamics and critical scaling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:09.689739Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:ff08ae95c56cf8b562241f54733baa4cd4d803749b1b6b9a74585a6d1cdc372e","observation_id":"7c4ee186-ed31-44c2-a7a0-65d68e331b73","resolution":{"observed_at":"2026-08-04T09:43:09.689739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:09.820533Z","title":"On-line learning with a perceptron.Europhysics Letters, 28(7):525, 1994","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:09.820533Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:67335e25aab1972abd5369f900cdebba0ff839a0c57104dd9071cea6847f4bf7","observation_id":"592d777b-d2b0-4249-a33a-0d0d9ac6677a","resolution":{"observed_at":"2026-08-04T09:43:09.820533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:09.941129Z","title":"Learning by on-line gradient descent","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:09.941129Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:7dc8813ce77e0f9b23dc881cc183f21eede2802411fc3d5aa36132685d116ecd","observation_id":"ae175791-8f25-4d48-9804-25b7baae7430","resolution":{"observed_at":"2026-08-04T09:43:09.941129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:10.059555Z","title":"Learning curves for sgd on structured features","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:10.059555Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:f1f1825d460703b0cb63668c74d5db2bc779c5b1c15a6e8ff0ddacaddf5abe03","observation_id":"911930c8-2506-470c-a881-4429791750c4","resolution":{"observed_at":"2026-08-04T09:43:10.059555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.07572","last_updated":"2026-04-18T03:31:29Z","snapshot_observed_at":"2026-07-06T12:18:42.245356Z","submitted_at":"2021-12-14T17:29:32Z","title":"The high-dimensional asymptotics of first order methods with random data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.07572","snapshot_observed_at":"2026-08-04T09:43:10.183758Z","title":"The high-dimensional asymptotics of first order methods with random data.arXiv preprint arXiv:2112.07572, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:10.183758Z"},"links":{"cited_paper":"/paper/2112.07572","citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:45ee61de1f0af3fc8fa7496fe95fa2e91b38593d86d8e5687cfe31753b6836c7","observation_id":"0b35ee0d-7fa7-405b-b2e8-ec3fcdda8a1d","resolution":{"observed_at":"2026-08-04T09:43:10.183758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:10.322964Z","title":"Sharp global convergence guarantees for iterative nonconvex optimization with random data.Ann","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:10.322964Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:e93221e743d7270bdaace984bf9b98589af79b7b716bf3c3ec67732d011e28f9","observation_id":"d7af9c46-eba3-4cfe-b74a-62b2e4f45cda","resolution":{"observed_at":"2026-08-04T09:43:10.322964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:10.489704Z","title":"Achieving optimal clustering in gaussian mixture models with anisotropic covariance structures","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:10.489704Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:12895543175dea37c634acd0accac4fa4ebf2c55ddff35b901ad08e9db449687","observation_id":"63db4703-0472-4232-87da-2088ce0fb78c","resolution":{"observed_at":"2026-08-04T09:43:10.489704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:10.616862Z","title":"Hitting the high- dimensional notes: An ode for sgd learning dynamics on glms and multi-index models.Information and Inference: A Journal of the IMA, 13(4):iaae028, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:10.616862Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:de69f21bdfdee6ad37bb5ee1ccdfc9b378c3f144936939b7f62a03ca9c7f1a16","observation_id":"9733b769-f2e7-4184-965f-10bd638991bb","resolution":{"observed_at":"2026-08-04T09:43:10.616862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:10.795167Z","title":"High-dimensional limit of one-pass SGD on least squares","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:10.795167Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:c959fe051f661cd37a88067e7a2f26ea8974d938834dacaee6e1a6e1701ffc13","observation_id":"0d2a9513-7772-4d20-9b5c-1b463757b0af","resolution":{"observed_at":"2026-08-04T09:43:10.795167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:10.920521Z","title":"Smoothing the landscape boosts the signal for sgd: Optimal sample complexity for learning single index models.Advances in Neural Information Processing Systems, 36:752–784, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:10.920521Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:4f93cd9f448a7c514f1dd4824c133ec9d3cdc2aeddae2d4b75e7f8d7b313c0c6","observation_id":"57f81619-5ad7-4279-9022-3b437ceea752","resolution":{"observed_at":"2026-08-04T09:43:10.920521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:11.046787Z","title":"Universality laws for gaussian mixtures in generalized linear models.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:11.046787Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:071541495ce707f2443d29cfa12b236cd826ed1b25d76bafba982318d92b0ac4","observation_id":"ca8ada67-5ec5-4a6e-abcc-8087aa093570","resolution":{"observed_at":"2026-08-04T09:43:11.046787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:11.142071Z","title":"The benefits of reusing batches for gradient descent in two-layer networks: Breaking the curse of information and leap exponents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:11.142071Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:4ae7000a7dfb12e8a8ffc63e06a8fa242244cc59aede6dcdc78d3b509390e4ac","observation_id":"79d8822b-e7d6-4a7b-963f-72e8ef0f720a","resolution":{"observed_at":"2026-08-04T09:43:11.142071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:11.291923Z","title":"High-dimensional asymptotics of prediction: Ridge regression and classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:11.291923Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:88651a9a88600b40559142b0b27e66e7d8ba5fe1b9ad98ba5afe7590fcd6fc9f","observation_id":"3cac6827-63f8-4bac-9b6e-2246a7db3ada","resolution":{"observed_at":"2026-08-04T09:43:11.291923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:11.411374Z","title":"Rigorous dynamical mean-field theory for stochastic gradient descent methods","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:11.411374Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:aa59438bfa08e14aa1eab01d7ac8924f84e695798beb940748f8907c9bc9b222","observation_id":"32f67fba-4131-4916-80df-010cb57c48fb","resolution":{"observed_at":"2026-08-04T09:43:11.411374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:11.557818Z","title":"Dynamics of stochastic gradient descent for two-layer neural networks in the teacher-student setup.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:11.557818Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:b935ce8d36ec33d26eb864427db8e8121a0211ca4e136eaebb40131575e8b28a","observation_id":"06024813-f1f2-4a30-99df-92033055e1a7","resolution":{"observed_at":"2026-08-04T09:43:11.557818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:11.680596Z","title":"The gaussian equivalence of generative models for learning with shallow neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:11.680596Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:dae6e6dc5debd6d97c60d069660224499908fa80033428579c7a3280ef1d893f","observation_id":"c914d719-70ce-4d17-98a2-000d0d772ebe","resolution":{"observed_at":"2026-08-04T09:43:11.680596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:11.824766Z","title":"Modeling the influence of data structure on learning in neural networks: The hidden manifold model.Physical Review X, 10(4):041044, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:11.824766Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:b7e0c5efbc791f2e58118ed6e05d80232906a5f3ba94eaacbd3be2279791516b","observation_id":"ebe60c50-00fb-467d-97f1-a9c1a4b1fb3b","resolution":{"observed_at":"2026-08-04T09:43:11.824766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.001956Z","title":"Minimax-optimal covariance projected spectral clustering for high- dimensional nonspherical mixtures.arXiv preprint arXiv:2502.02580, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.001956Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:45f3aa34f97f68ecb8ddbb43a647807da8d544b119f207d498ad0441dfccb0a2","observation_id":"c8fafa65-3eec-46e0-80d4-2054cc3e4fa4","resolution":{"observed_at":"2026-08-04T09:43:12.001956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.170682Z","title":"Fast margin maximization via dual acceleration","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.170682Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:c908eb7eda7f1d24e4161e434aab4056b312d6ad7960aa036e3537724168094b","observation_id":"d5dee034-428e-42b1-af0b-a078d524f833","resolution":{"observed_at":"2026-08-04T09:43:12.170682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.350658Z","title":"Characterizing the implicit bias via a primal-dual analysis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.350658Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:ac9fcccf2b9c7d64799a80388f1b12334a8a83edd9a5e54e396725b1be93b365","observation_id":"23e8dfae-b4d7-48fe-913f-740e913dd6aa","resolution":{"observed_at":"2026-08-04T09:43:12.350658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.479518Z","title":"Trajectory of mini-batch momentum: batch size saturation and convergence in high dimensions.Advances in Neural Information Processing Systems, 35:36944–36957, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.479518Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:6c22ca0c1430ea5b97cbe30c81a7d3d406beb28e308baa1bcd1a52026aaff881","observation_id":"225d8dd0-1a8d-46ae-af0f-116d5d8e0ea7","resolution":{"observed_at":"2026-08-04T09:43:12.479518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.607058Z","title":"Phase transitions and optimal algorithms in high-dimensional gaussian mixture clustering","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.607058Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:5242efac4404ab70876b718c1d8eb2dddb0df9eca42bfcc6f736c2d35c8d851e","observation_id":"f6398622-2e8f-4bcd-90c5-c1fd43371e18","resolution":{"observed_at":"2026-08-04T09:43:12.607058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.723229Z","title":"Optimality of spectral clustering in the gaussian mixture model.The Annals of Statistics, 49(5):2506–2530, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.723229Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:a75c8627bf5cdf990d0d4bbedb04c0326ec25d7b054090133f69803b72077750","observation_id":"7e71a636-828d-4233-b751-052319f99cae","resolution":{"observed_at":"2026-08-04T09:43:12.723229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.822188Z","title":"Learning curves of generic features maps for realistic datasets with a teacher-student model","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.822188Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:bfa048edf428cf9210d87171f793b19110c5cb6390736efb53d4a38831d9e8e3","observation_id":"edd76747-7d6b-432f-a13e-91284c25cfb3","resolution":{"observed_at":"2026-08-04T09:43:12.822188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:12.932987Z","title":"Learning gaussian mixtures with generalized linear models: Precise asymptotics in high- dimensions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:12.932987Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:7f6a4a1979b6e72e9b91383bc77b708412426960476b9fed554ad063950c9794","observation_id":"0b0923cf-3f23-402d-97f9-d8ee74acd3c6","resolution":{"observed_at":"2026-08-04T09:43:12.932987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.108461Z","title":"High dimensional classification via regularized and unregularized empirical risk minimization: Precise error and optimal loss.stat, 1050:25, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.108461Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:62fe8aa0ad14137c0935cc0410d2b7c30cf7a3035158039352754c6cd00be7db","observation_id":"0ef4e9f0-f1d2-40cf-bfbf-b4f6e456a810","resolution":{"observed_at":"2026-08-04T09:43:13.108461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.248060Z","title":"Dynamical mean- field theory for stochastic gradient descent in gaussian mixture classification","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.248060Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:8b1ab2181a4177607fe7fafe600433342e845c840bb0577c34eed1759b5a3cb8","observation_id":"94a02753-fd48-422c-b009-0b2c9279c068","resolution":{"observed_at":"2026-08-04T09:43:13.248060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.365838Z","title":"Convergence of gradient descent on separable data","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.365838Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:6adb0b2ca86dff1d870c21257f834a5b85663d3ea358ae7f515c2076fc16c13d","observation_id":"5fc4034c-9c7f-46c7-a8a4-fc16225d5a0b","resolution":{"observed_at":"2026-08-04T09:43:13.365838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.415028Z","title":"The full spectrum of deepnet hessians at scale: Dynamics with SGD training and sample size","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.415028Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:9fe45ec5dae51e774855976c208198ab059e359c0275685530856f3b360c234c","observation_id":"94acbf43-863a-41c0-8ade-931efa361d56","resolution":{"observed_at":"2026-08-04T09:43:13.415028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.525208Z","title":"Homogenization of SGD in high-dimensions: Exact dynamics and generalization properties.Mathematical Programming, pages 1–90, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.525208Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:980fbf9d2fa27e2c98c47450800d048fd8f24b7dcc1074750d3a1be99d701b3f","observation_id":"5106c7c0-c783-4452-9c28-74467aafc06b","resolution":{"observed_at":"2026-08-04T09:43:13.525208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.637708Z","title":"Classifying high-dimensional gaussian mixtures: Where kernel methods fail and neural networks succeed","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.637708Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:33cf3f017e4fd474d0fd42ce6c38eb8b74279fb57c1482e861a73fbf0db02adc","observation_id":"b3c8c4f7-e21b-4323-a5d8-9169e8675505","resolution":{"observed_at":"2026-08-04T09:43:13.637708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.730146Z","title":"Dynamics of on-line gradient descent learning for multilayer neural networks","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.730146Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:4316c43ac50ceb276929f8f14e60bc66c6dcfec72f7e39315a6432e884fc0eef","observation_id":"6f17a1bd-6c00-4098-bbba-d05b57cd5784","resolution":{"observed_at":"2026-08-04T09:43:13.730146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.817228Z","title":"Exact solution for on-line learning in multilayer neural networks.Physical Review Letters, 74(21):4337, 1995","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.817228Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:0cc1a807dcf0d3b352749b09b5819301cd0166f6d95e54db6c841b9462ec8e83","observation_id":"6a9f716a-6a39-40f6-b100-620b1cecb8c5","resolution":{"observed_at":"2026-08-04T09:43:13.817228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.927373Z","title":"Random matrix theory proves that deep learning representations of gan-data behave as gaussian mixtures","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.927373Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:4bbe2d29d06456b7bb3f8d3f3528fa8b0158b6eb94a83a1e044bab3e30d70e1f","observation_id":"1d808604-d48f-49d5-b3b7-56d3760c80d1","resolution":{"observed_at":"2026-08-04T09:43:13.927373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:13.996903Z","title":"The implicit bias of gradient descent on separable data.Journal of Machine Learning Research, 19(70):1–57, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:13.996903Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:ad51f1dc772708594b6732974af5ef077b3dead6f8c50ab7fb6f713f69aad5bb","observation_id":"c2c46541-cdc7-4cbd-b22a-4d2ac218a089","resolution":{"observed_at":"2026-08-04T09:43:13.996903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:14.080787Z","title":"Theoretical insights into multiclass classification: A high-dimensional asymptotic view.Advancesin Neural Information Processing Systems, 33:8907–8920, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:14.080787Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:0dd16503dc9260600dd7d90bcc0a8d89ed292dc54c2a40ac093c5a094f4b464b","observation_id":"2bfc8f03-f74c-426f-b1dd-38207e5af8e4","resolution":{"observed_at":"2026-08-04T09:43:14.080787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:14.145212Z","title":"High-dimensional probability, volume 47 of Cambridge Series in Statistical and Probabilistic Mathematics","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:14.145212Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:309c03df0824588ffcddba377040b2865f669a30e8bd1c31e14d600b0061d2c1","observation_id":"308282da-29b1-498b-9f11-00bc0abb34d7","resolution":{"observed_at":"2026-08-04T09:43:14.145212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:14.251094Z","title":"A solvable high-dimensional model of GAN.Advances in Neural Information Processing Systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:14.251094Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:824965b6bf612004ba676e3d56b40aca1eff53b3530d2e2c30da5955725e13f2","observation_id":"beecbc06-f7e0-41f5-8703-868135500140","resolution":{"observed_at":"2026-08-04T09:43:14.251094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:43:14.326705Z","title":"Data-dependence of plateau phenomenon in learning with neural network—statistical mechanical analysis.Advancesin Neural Information Processing Systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T09:43:14.326705Z"},"links":{"citing_paper":"/paper/2510.14074"},"observation_digest":"sha256:650503e6165414eacf265096a0aeeef0ecbd7e99beea28bd6c4abc3b85390be6","observation_id":"3f4f2410-360e-4d5b-83c9-ba29d89f0567","resolution":{"observed_at":"2026-08-04T09:43:14.326705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.14074","last_updated":"2026-07-13T16:53:33Z","latest_version":2,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-16T09:00:03.853321Z","submitted_at":"2025-10-15T20:31:49Z","title":"Exact Dynamics of Multi-class Stochastic Gradient Descent"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 1 inbound Pith citation observation for arXiv:2510.14074."}