{"as_of":"2026-08-10T23:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8c04949c31ff4b37c78e618ed6401ed7f2dfe08860ef6b3613f7900e28a0ca74","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:56:21.795284Z","state":"measured"},{"denominator":88,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":88,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:22:15.304977Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12224","snapshot_observed_at":"2026-08-06T04:22:15.304977Z","title":"Optimizers qualitatively alter solutions and we should leverage this,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03649","last_updated":"2025-08-05T16:57:24Z","snapshot_observed_at":"2026-08-06T04:22:14.596374Z","submitted_at":"2025-08-05T16:57:24Z","title":"Cross-Model Semantics in Representation Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T04:22:15.304977Z"},"links":{"cited_paper":"/paper/2507.12224","citing_paper":"/paper/2508.03649"},"observation_digest":"sha256:93354812af31b1e0e3c7566a51999a9af1726cb9f67af5fa85bf7778fcc5eee7","observation_id":"125f7d68-abbc-497f-a761-6eddc3f384fd","resolution":{"observed_at":"2026-08-06T04:22:15.304977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"cited_work":{"arxiv_id":"2507.12224","doi":"10.48550/arxiv.2507.12224","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Optimizers qualitatively alter solutions and we should leverage this","venue":"ArXiv.org","work_id":"2c3638b4-b599-4ba7-a22b-debecf8353a0","year":2022},"citing_paper":{"arxiv_id":"2510.04686","last_updated":"2026-04-21T09:01:24Z","snapshot_observed_at":"2026-08-02T11:55:04.825901Z","submitted_at":"2025-10-06T10:56:41Z","title":"How does the optimizer implicitly bias the model merging loss landscape?","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T09:49:41.550981Z"},"links":{"cited_paper":"/paper/2507.12224","citing_paper":"/paper/2510.04686"},"observation_digest":"sha256:8c9ff092ffb351c41d75c277bf7b17ac9f58f108f89f7ca5243da5daddcb3cfa","observation_id":"558ba87f-680f-4c22-aa79-602ef4f30be9","resolution":{"observed_at":"2026-05-18T09:51:13.425976Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"cited_work":{"arxiv_id":"2507.12224","doi":"10.48550/arxiv.2507.12224","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Optimizers qualitatively alter solutions and we should leverage this","venue":"ArXiv.org","work_id":"2c3638b4-b599-4ba7-a22b-debecf8353a0","year":2022},"citing_paper":{"arxiv_id":"2604.20365","last_updated":"2026-04-22T09:02:14Z","snapshot_observed_at":"2026-07-31T16:18:31.194212Z","submitted_at":"2026-04-22T09:02:14Z","title":"Benefits of Low-Cost Bio-Inspiration in the Age of Overparametrization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T00:21:37.686664Z"},"links":{"cited_paper":"/paper/2507.12224","citing_paper":"/paper/2604.20365"},"observation_digest":"sha256:d5f531dbc81a27e661f678f244e7887311923dbc9cb411524d00ec03142eeb62","observation_id":"3ef28a47-5dc6-4f83-a96d-f73b047389de","resolution":{"observed_at":"2026-05-10T00:24:46.477571Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"cited_work":{"arxiv_id":"2507.12224","doi":"10.48550/arxiv.2507.12224","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Optimizers qualitatively alter solutions and we should leverage this","venue":"ArXiv.org","work_id":"2c3638b4-b599-4ba7-a22b-debecf8353a0","year":2022},"citing_paper":{"arxiv_id":"2605.21803","last_updated":"2026-05-20T23:00:34Z","snapshot_observed_at":"2026-08-01T18:06:03.629869Z","submitted_at":"2026-05-20T23:00:34Z","title":"Same Architecture, Different Capacity: Optimizer-Induced Spectral Scaling Laws","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T08:49:32.864065Z"},"links":{"cited_paper":"/paper/2507.12224","citing_paper":"/paper/2605.21803"},"observation_digest":"sha256:f2a595240e02d50135337894cce6367e6555bd84f72b308a2091b0660b293693","observation_id":"79f339b7-602b-4362-8404-1d07f0f08213","resolution":{"observed_at":"2026-05-22T08:51:18.269939Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"cited_work":{"arxiv_id":"2507.12224","doi":"10.48550/arxiv.2507.12224","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Optimizers qualitatively alter solutions and we should leverage this","venue":"ArXiv.org","work_id":"2c3638b4-b599-4ba7-a22b-debecf8353a0","year":2022},"citing_paper":{"arxiv_id":"2605.27662","last_updated":"2026-05-26T20:25:44Z","snapshot_observed_at":"2026-08-01T16:04:11.431819Z","submitted_at":"2026-05-26T20:25:44Z","title":"How the Optimizer Shapes Learned Solutions in Equivariant Neural Networks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T17:59:03.152111Z"},"links":{"cited_paper":"/paper/2507.12224","citing_paper":"/paper/2605.27662"},"observation_digest":"sha256:30bb2e4e7b591a5e1e5d309791fc7b870f42025933b43272700fd7ce2b22dcf2","observation_id":"0751ef79-8d03-46b6-8692-4a2254da0e66","resolution":{"observed_at":"2026-06-29T18:03:48.001449Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"cited_work":{"arxiv_id":"2507.12224","doi":"10.48550/arxiv.2507.12224","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Optimizers qualitatively alter solutions and we should leverage this","venue":"ArXiv.org","work_id":"2c3638b4-b599-4ba7-a22b-debecf8353a0","year":2022},"citing_paper":{"arxiv_id":"2606.11123","last_updated":"2026-06-09T17:21:25Z","snapshot_observed_at":"2026-08-06T11:25:30.226674Z","submitted_at":"2026-06-09T17:21:25Z","title":"Overcoming Rank Collapse in Feedback Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T13:52:57.960921Z"},"links":{"cited_paper":"/paper/2507.12224","citing_paper":"/paper/2606.11123"},"observation_digest":"sha256:2bd527a310aad8445a644266d8f3de9d6f6f2b5b166c09c099f0db89e8d0b889","observation_id":"e611b25f-9546-4e74-86f1-1ac495debd39","resolution":{"observed_at":"2026-07-03T04:27:37.207966Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12224","snapshot_observed_at":"2026-08-01T17:31:48.677047Z","title":"Optimizers qualitatively alter solu- tions and we should leverage this.arXiv preprint arXiv:2507.12224,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17624","last_updated":"2026-07-20T07:26:17Z","snapshot_observed_at":"2026-08-07T13:43:21.717264Z","submitted_at":"2026-07-20T07:26:17Z","title":"Can Transformers Really Do It All? On the Compatibility of Inductive Biases Across Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T17:31:48.677047Z"},"links":{"cited_paper":"/paper/2507.12224","citing_paper":"/paper/2607.17624"},"observation_digest":"sha256:67c5c9ec6f62d04658de8cc04127fcc146d446243ed438b53f76e75c3876a57f","observation_id":"8f9fb4d3-38b5-4b8a-b259-256ee344464b","resolution":{"observed_at":"2026-08-01T17:31:48.677047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.12224/citation-record","integrity":"/paper/2507.12224/integrity","json":"/paper/2507.12224/citation-record.json","paper":"/paper/2507.12224"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1710.03667","last_updated":"2017-10-10T15:48:12Z","snapshot_observed_at":"2026-08-05T16:01:52.576963Z","submitted_at":"2017-10-10T15:48:12Z","title":"High-dimensional dynamics of generalization error in neural networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.03667","snapshot_observed_at":"2026-08-06T16:56:21.467822Z","title":"Advani and Andrew M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.467822Z"},"links":{"cited_paper":"/paper/1710.03667","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:a2778cb8e75ddfbbbcba086d12437bac1a2a0b821b69b4a4b01c0f1d11cc364b","observation_id":"13570ae0-c803-4c82-a256-42816735eadf","resolution":{"observed_at":"2026-08-06T16:56:21.467822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.05421","last_updated":"2019-04-12T14:47:02Z","snapshot_observed_at":"2026-07-06T06:44:49.023966Z","submitted_at":"2018-06-14T09:06:10Z","title":"Selfless Sequential Learning","version":5},"cited_work":{"arxiv_id":"1806.05421","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.05421","snapshot_observed_at":"2026-08-06T16:56:23.070621Z","title":"Selfless Sequential Learning","venue":"stat.ML","work_id":"7c02bd6c-e9c1-4308-808e-0680256a4def","year":2018},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.475398Z"},"links":{"cited_paper":"/paper/1806.05421","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:d09a4ea6c4290d9f312e7df777c5317558a38674716aee016c34f825d57275c2","observation_id":"c861194e-09b7-4c0a-9422-0e3ca5c8b8ce","resolution":{"observed_at":"2026-08-06T16:56:23.128971Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.479422Z","title":"Learning and generalization in overparame- terized neural networks, going beyond two layers","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.479422Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:0106d689db79df5b7a6c1a026e44e430a33ad9260cce362ea1887f9f0805756a","observation_id":"1ced9c68-3efb-49c0-841c-13e4a47293cb","resolution":{"observed_at":"2026-08-06T16:56:21.479422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.483888Z","title":"Natural gradient works efficiently in learning","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.483888Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:4de0b607590aaa14d2004c70fccdc31685be5890f90a01c4571e19107490a31e","observation_id":"c6b3db26-9fae-4090-bc2b-9192ce5efafe","resolution":{"observed_at":"2026-08-06T16:56:21.483888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:30.554481Z","title":"When does preconditioning help or hurt generalization? 2020","venue":null,"work_id":"c98f31ce-0ab4-4c90-9773-732bccfa708c","year":2020},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.488150Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:bb74c3ee0285c3ccfb3ecfa92cf001588c45c44dfae5df4a4231020953d87f77","observation_id":"bd3a1dca-2e74-4d63-807d-c75ec80a60bf","resolution":{"observed_at":"2026-08-06T16:56:30.616739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.13655","last_updated":"2019-10-26T07:09:24Z","snapshot_observed_at":"2026-08-05T12:07:30.166192Z","submitted_at":"2019-05-31T14:54:36Z","title":"Implicit Regularization in Deep Matrix Factorization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13655","snapshot_observed_at":"2026-08-06T16:56:21.492418Z","title":"Implicit regularization in deep matrix factorization, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.492418Z"},"links":{"cited_paper":"/paper/1905.13655","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:e444b6cb3cf58a742be9501fb6aa6a934d051f6b99d6df778bd4046546fdde91","observation_id":"75d79d22-da28-4cff-8d4b-0e060bc218a3","resolution":{"observed_at":"2026-08-06T16:56:21.492418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11162","last_updated":"2022-07-18T20:57:25Z","snapshot_observed_at":"2026-07-06T09:58:08.880543Z","submitted_at":"2020-09-23T14:17:53Z","title":"Implicit Gradient Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11162","snapshot_observed_at":"2026-08-06T16:56:21.496667Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.496667Z"},"links":{"cited_paper":"/paper/2009.11162","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:250ea13ecd844a2bdb5468a1d44843a585f7e9c7a66b86f29818b4dfceb5918c","observation_id":"469237c1-e7b6-4730-92df-245978afd23e","resolution":{"observed_at":"2026-08-06T16:56:21.496667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.500701Z","title":"Reconciling modern machine- learning practice and the classical bias–variance trade-off.Proceedings of the National Academy of Sciences, 116(32):15849–15854, July 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.500701Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:3cd50303d83c46893e5a515f5ca1d03203676b07b02682d3675945f35792ef66","observation_id":"d74e641f-4675-4159-b3b4-deee2d616393","resolution":{"observed_at":"2026-08-06T16:56:21.500701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:30.347128Z","title":"Learning deep architectures for ai","venue":null,"work_id":"5366511b-1d4b-425d-9518-024b9dff7639","year":2009},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.504094Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:77b1fab3316ce19c142ed067e800c4ce2e4de19c6878164cda4d9a264e544172","observation_id":"6c954426-2e54-4417-9e31-17200f66ee3f","resolution":{"observed_at":"2026-08-06T16:56:30.433864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:30.178248Z","title":"Scaling Learning Algorithms towards AI","venue":null,"work_id":"193c1e2e-30b4-4e46-85a6-56a10c630677","year":2007},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.508763Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:49fa0add6c4a079371374e45aa72408c70be36cca0ee83acebdbb6238eccee4f","observation_id":"7a367dce-023b-49e0-8bfc-301d37fdac82","resolution":{"observed_at":"2026-08-06T16:56:30.261518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:29.937843Z","title":"Greedy layer-wise training of deep networks","venue":null,"work_id":"eacf69a6-86b5-4881-b4f7-d720bf343533","year":2006},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.512251Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:e9728fe22f49d35e15ade5298a73a5162c89073c8c8c8815bb545f95272093c0","observation_id":"f8b94d34-9176-4b24-85ca-32bdc4d9e6a5","resolution":{"observed_at":"2026-08-06T16:56:30.092830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20325","last_updated":"2024-12-06T14:09:22Z","snapshot_observed_at":"2026-08-03T03:18:47.425243Z","submitted_at":"2024-09-30T14:26:12Z","title":"Old Optimizer, New Norm: An Anthology","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20325","snapshot_observed_at":"2026-08-06T16:56:21.515682Z","title":"Old optimizer, new norm: An anthology, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.515682Z"},"links":{"cited_paper":"/paper/2409.20325","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:0a9f96a1c2f2e76342661442b58718982d3248a452fe10b62d1c5b94b66683fe","observation_id":"f437dcf3-da5b-4491-ae2a-ae9c67b16592","resolution":{"observed_at":"2026-08-06T16:56:21.515682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:29.799556Z","title":"The tradeoffs of large scale learning","venue":null,"work_id":"89331dfe-2dcc-4059-931b-59f39a746313","year":2007},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.519396Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:7751bfd381e996040e21a11d1ea98cc5f5dbccb56a3fe8f96b4e8f575fb0382d","observation_id":"b4d81502-93b5-4350-9b9e-fc621a306351","resolution":{"observed_at":"2026-08-06T16:56:29.873526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:29.691082Z","title":"Large scale online learning","venue":null,"work_id":"967a44a3-d561-42e9-b2ff-76e09373ce3d","year":2003},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.522553Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:f709cf90b0133560acb650c38859753029d5f6ccf378a99b415af8ba39595b02","observation_id":"a88f1dc2-487e-4c30-acd5-6bf3c6df2934","resolution":{"observed_at":"2026-08-06T16:56:29.734055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-06T16:56:21.526427Z","title":"Chayes, Levent Sagun, and Riccardo Zecchina","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.526427Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:45f45df4d1cbec1d6b507fdf76806b77e8f401f1ce7e47bf3034342d002db546","observation_id":"cccf5ace-63da-43b2-b3e6-004ac0f53179","resolution":{"observed_at":"2026-08-06T16:56:21.526427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:29.573983Z","title":"On lazy training in differentiable program- ming","venue":null,"work_id":"a8a5ad8f-fcc7-4e31-8928-43e7f6e09ec9","year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.530713Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:76eacde3b16df5ade4ff971659dbe861ec3644d7b13ebae99597f2557cf06211","observation_id":"5c1c6b40-1bd1-4546-b316-d76d6c9cba97","resolution":{"observed_at":"2026-08-06T16:56:29.654561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:29.403491Z","title":"Open problem: The landscape of the loss surfaces of multilayer networks","venue":null,"work_id":"82580912-93d1-4c61-9539-afb28267dbce","year":2015},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.534425Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:195baeff71d3c9a51b0eb318eff7676a9bd2f8e80d2dc7a91e687515c430baf4","observation_id":"897a9b41-108d-48dd-8398-a46d9495f9e3","resolution":{"observed_at":"2026-08-06T16:56:29.463766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:29.248954Z","title":"Turing completeness of bounded-precision recurrent neural networks","venue":null,"work_id":"1d74f8ec-52a6-4eb0-ab2b-31001101c105","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.537875Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:23a1316b43d8987e3d9c8240e2414cfad1115cc3a13840dc63621d1756eb560c","observation_id":"2c8e19f8-6588-489a-bffe-2d40ea1ab63f","resolution":{"observed_at":"2026-08-06T16:56:29.323915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:29.102146Z","title":"Dauphin, Razvan Pascanu, Caglar Gulcehre, Kyunghyun Cho, Surya Ganguli, and Yoshua Bengio","venue":null,"work_id":"8cce0aed-72c0-4b18-aa61-6f333f58e893","year":2014},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.541561Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:bc6b36d1c2f7c802c84769072c40ff2dead75676752d064202489672239dbb1f","observation_id":"cb33a1e1-0e8e-4737-b102-94d04b97af92","resolution":{"observed_at":"2026-08-06T16:56:29.166063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.545762Z","title":"A continual learning survey: Defying forgetting in classification tasks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.545762Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:969806149c5026d4cd248a6221c012e42707cb80c8e2970e2d60367972cf96bd","observation_id":"2f3d241c-f3e2-4a1f-87b8-a99034d1aba4","resolution":{"observed_at":"2026-08-06T16:56:21.545762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.04933","last_updated":"2017-05-15T23:33:19Z","snapshot_observed_at":"2026-08-10T12:26:05.659088Z","submitted_at":"2017-03-15T05:12:25Z","title":"Sharp Minima Can Generalize For Deep Nets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.04933","snapshot_observed_at":"2026-08-06T16:56:21.549446Z","title":"Sharp minima can generalize for deep nets, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.549446Z"},"links":{"cited_paper":"/paper/1703.04933","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:5e1d21ea0a9780aab5b4683339fad5d91f7a80ebdc552808b87290b64756ea72","observation_id":"f38362ca-12a6-4277-bd76-3dc258c2e9a9","resolution":{"observed_at":"2026-08-06T16:56:21.549446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:28.951056Z","title":"A theoretical analysis of catastrophic forgetting through the ntk overlap matrix","venue":null,"work_id":"a29ab785-6df3-4970-9732-19d6e3c1b4a2","year":null},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.554410Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:72475c4fb60a9847b94f8e6e1988b40ce5d8683cc3663bbfa0662d403a86ea1e","observation_id":"747d978e-5c6b-4ff7-b248-63468021947f","resolution":{"observed_at":"2026-08-06T16:56:29.005838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.06325","last_updated":"2022-05-05T17:16:00Z","snapshot_observed_at":"2026-07-06T11:38:09.580962Z","submitted_at":"2021-08-13T17:33:47Z","title":"Continual Backprop: Stochastic Gradient Descent with Persistent Randomness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.06325","snapshot_observed_at":"2026-08-06T16:56:21.558771Z","title":"Continual backprop: Stochastic gradient descent with persistent randomness","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.558771Z"},"links":{"cited_paper":"/paper/2108.06325","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:1fde1dab343d24ca800049e085716c045b86e3d27c407f332072fcb09367b15a","observation_id":"6141deb0-1f43-459e-96cb-e193431be8df","resolution":{"observed_at":"2026-08-06T16:56:21.558771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15632","last_updated":"2024-01-12T16:13:26Z","snapshot_observed_at":"2026-07-06T15:47:26.532273Z","submitted_at":"2023-06-27T17:13:20Z","title":"Asynchronous Algorithmic Alignment with Cocycles","version":3},"cited_work":{"arxiv_id":"2306.15632","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.15632","snapshot_observed_at":"2026-08-06T16:56:22.796135Z","title":"Asynchronous Algorithmic Alignment with Cocycles","venue":"cs.LG","work_id":"ef1d0354-8e49-493c-8ed8-3b334dab5d4e","year":2023},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.562471Z"},"links":{"cited_paper":"/paper/2306.15632","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:d86950e4f7a3f3929ee4d5e9bf8889f35064cf27722560fc10228b4a66f3e01c","observation_id":"533c354a-1237-4521-8eea-3d0e96f81c26","resolution":{"observed_at":"2026-08-06T16:56:22.860575Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:28.786510Z","title":null,"venue":null,"work_id":"9a565b0a-5170-492e-b81a-408be494cd2c","year":2010},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.566076Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:378ed3318342bab2b793d7406bc24573b5729fe5ccfcc776b2888d80e593f8b8","observation_id":"5a17fd0e-87a3-43c1-91bb-c1fa4d784c60","resolution":{"observed_at":"2026-08-06T16:56:28.862630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:28.634446Z","title":"Model-agnostic meta-learning for fast adap- tation of deep networks","venue":null,"work_id":"bfb55686-3b6a-4d62-b001-87338bbe3949","year":2017},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.569208Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:4050bc55f9520ad06bad1c956b0cb155ed696263beb805d4a9fe8d060100b43e","observation_id":"2ce53fbe-13c8-4c2b-8b45-f872f7a585b7","resolution":{"observed_at":"2026-08-06T16:56:28.723255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:28.462246Z","title":"Sharpness-aware min- imization for efficiently improving generalization","venue":null,"work_id":"9263820f-d14b-450d-8462-9464422df3a9","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.572373Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:fe5ea68974043048b84e842805b1b1e0115ed0d8b3ae70c293b3e8821e1c96ff","observation_id":"748c4011-b463-402d-bf87-4c1765fdf4d1","resolution":{"observed_at":"2026-08-06T16:56:28.523574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.13343","last_updated":"2022-02-24T17:49:35Z","snapshot_observed_at":"2026-07-06T11:13:26.218341Z","submitted_at":"2021-05-27T17:51:09Z","title":"Drawing Multiple Augmentation Samples Per Image During Training Efficiently Decreases Test Error","version":2},"cited_work":{"arxiv_id":"2105.13343","doi":null,"metadata_source":"pith","pith_arxiv_id":"2105.13343","snapshot_observed_at":"2026-08-06T16:56:22.653912Z","title":"Drawing Multiple Augmentation Samples Per Image During Training Efficiently Decreases Test Error","venue":"cs.LG","work_id":"83752ff5-020f-47f6-8c01-9cafb4c8ebea","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.576383Z"},"links":{"cited_paper":"/paper/2105.13343","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:3622dfd0c207114075391b96c5fb4970ed2a20e938a5c4af13fb838c3edc33e9","observation_id":"3d8970fe-db91-4f42-9aad-da7d2f3aef40","resolution":{"observed_at":"2026-08-06T16:56:22.690277Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.06898","last_updated":"2020-12-12T20:01:33Z","snapshot_observed_at":"2026-08-07T18:31:32.563809Z","submitted_at":"2020-12-12T20:01:33Z","title":"Revisiting \"Qualitatively Characterizing Neural Network Optimization Problems\"","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.06898","snapshot_observed_at":"2026-08-06T16:56:21.580819Z","title":"qualitatively characterizing neural network optimization prob- lems","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.580819Z"},"links":{"cited_paper":"/paper/2012.06898","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:38b4b6692579e868af415da2748a0b72460f26718cbad65e6a5fc05b29dc8925","observation_id":"4423f3ef-2552-47a3-8430-f043af68336f","resolution":{"observed_at":"2026-08-06T16:56:21.580819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.585238Z","title":"Catastrophic forgetting in connectionist networks","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.585238Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:b12723bcc77ca9f6a7c43d78207859f30676e50aa9a25346a9238efe87eb95dd","observation_id":"e99111d3-feea-48eb-9c4c-a060c2c3a578","resolution":{"observed_at":"2026-08-06T16:56:21.585238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.590032Z","title":"Understanding the difficulty of training deep feedforward neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.590032Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:94ed87e9229ce11c52beb10214675922bfa72390d49d7c75be87bb56b6cc4151","observation_id":"8fc44f1c-50f2-4069-aedb-1965d9cbc189","resolution":{"observed_at":"2026-08-06T16:56:21.590032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6544","last_updated":"2015-05-21T21:44:31Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-19T21:55:01Z","title":"Qualitatively characterizing neural network optimization problems","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6544","snapshot_observed_at":"2026-08-06T16:56:21.594131Z","title":"Goodfellow, Oriol Vinyals, and Andrew Saxe","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.594131Z"},"links":{"cited_paper":"/paper/1412.6544","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:e28c761f926e5d7dd4ac4f90b5735b6e7f47ca1912e2afe1976719c78300a6d9","observation_id":"74f2a661-6894-4837-87f7-d2b82d47b602","resolution":{"observed_at":"2026-08-06T16:56:21.594131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14050","last_updated":"2020-09-29T14:37:12Z","snapshot_observed_at":"2026-07-06T09:59:50.601893Z","submitted_at":"2020-09-29T14:37:12Z","title":"Understanding Human Intelligence through Human Limitations","version":1},"cited_work":{"arxiv_id":"2009.14050","doi":null,"metadata_source":"pith","pith_arxiv_id":"2009.14050","snapshot_observed_at":"2026-08-06T16:56:22.534700Z","title":"Understanding Human Intelligence through Human Limitations","venue":"cs.AI","work_id":"b931089f-b15b-445d-b53f-85336f4a6a03","year":2020},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.598106Z"},"links":{"cited_paper":"/paper/2009.14050","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:c6c53682b4133b0c3f74d257d1131174454164eba3f2bfa04d314d2b63748dc6","observation_id":"649a1ff6-5400-477a-baf2-c2bdd9b365ac","resolution":{"observed_at":"2026-08-06T16:56:22.572734Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.09568","last_updated":"2018-03-02T00:12:58Z","snapshot_observed_at":"2026-08-08T05:45:32.956312Z","submitted_at":"2018-02-26T19:36:41Z","title":"Shampoo: Preconditioned Stochastic Tensor Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.09568","snapshot_observed_at":"2026-08-06T16:56:21.602594Z","title":"Shampoo: Preconditioned stochastic tensor optimization, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.602594Z"},"links":{"cited_paper":"/paper/1802.09568","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:0cdeb08e0bae09db505130b70475450019857c1bc2e87d94ec93e2261d47ef36","observation_id":"e096c52e-540f-41ac-81ed-8e44415590fe","resolution":{"observed_at":"2026-08-06T16:56:21.602594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:28.324861Z","title":"Embracing change: Con- tinual learning in deep neural networks","venue":null,"work_id":"9d8ff032-734d-4360-94b5-7e2b00138dc2","year":2020},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.606621Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:9e858657bccdafd749cae12fa96d53a7cef168520fd6e57eba4407043cdce661","observation_id":"db15b856-f66e-4d4e-b3ec-c971c6daf38f","resolution":{"observed_at":"2026-08-06T16:56:28.383613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.610852Z","title":"Hinton, Simon Osindero, and Yee-Whye Teh","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.610852Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:42cb31cb97ed42536a06f25b49921e359d442372d17a642a17fcb255b7834c59","observation_id":"183dc493-937b-4249-b4c0-1c1bde22c7eb","resolution":{"observed_at":"2026-08-06T16:56:21.610852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:28.185561Z","title":"Flat minima","venue":null,"work_id":"cc2f138a-fdb1-4828-87aa-1d4853f70e80","year":null},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.614692Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:fb1daf4348926286c2f257d29274af009cceed535c7cd919037775e1d6afac16","observation_id":"307206eb-0756-4a36-8062-2ba85e6ca0c7","resolution":{"observed_at":"2026-08-06T16:56:28.254650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:28.005739Z","title":"Neural tangent kernel: Convergence and generalization in neural networks","venue":null,"work_id":"ceb1f8e8-cb10-4a10-a60e-0fbb4d0f8cc3","year":2018},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.623377Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:cdf9c37fa90303b6fe0e79de6014d027517162e50bc42aca56044c875a54f807","observation_id":"5d73982b-3a2c-4759-8c88-2b84449b89f0","resolution":{"observed_at":"2026-08-06T16:56:28.078427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:27.851124Z","title":"On large-batch training for deep learning: Generalization gap and sharp minima","venue":null,"work_id":"8fef6f85-9248-4f45-a8f2-b876c1a9a5a7","year":2017},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.627836Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:a80501f4d7b42a6415adf6e43e38c5095c44faab424fe3af12526d587f28dcea","observation_id":"ee7fef34-9400-438d-b218-134a9bf34e45","resolution":{"observed_at":"2026-08-06T16:56:27.930579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:27.635334Z","title":"Overcoming catastrophic forgetting in neural networks","venue":null,"work_id":"d96c8219-a44c-4e1c-b9f6-e56bbcd80f85","year":2017},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.631796Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:97fa2fccd3fd14930067f7cb602bbcb92587c9f71cc73946953ed33f3e4d890f","observation_id":"a6fe436c-01cc-4d29-9308-3ea4bb61447d","resolution":{"observed_at":"2026-08-06T16:56:27.752349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:27.358298Z","title":null,"venue":null,"work_id":"227396e0-0921-4aae-a673-2670b79ff6d1","year":2012},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.635133Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:e1c934303a2dc5d7663bef9d4b49656eefd1384d0b3e770ad97535fb0dd7dc91","observation_id":"48c7779c-780a-4606-80b1-9b85a2aeab88","resolution":{"observed_at":"2026-08-06T16:56:27.484674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:27.060094Z","title":"Continual learning as computationally constrained reinforcement learning,","venue":null,"work_id":"5069636f-9138-44e6-a5dd-de4d14cd615f","year":null},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.639198Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:d5fbf6e7abfe1eac7b023dfaf45f89324101198b041a5b6bd5983ade8a254298","observation_id":"db085b21-2a5c-4f87-9168-714a28f61086","resolution":{"observed_at":"2026-08-06T16:56:27.212185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:26.768952Z","title":"Maintaining plasticity in continual learning via regenerative regularization","venue":null,"work_id":"431108e3-18c2-415d-9e71-e74831f1edf6","year":2024},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.647639Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:4ed1be810213107d61946d5af0e764e70e8108f8e0cf98d460f8f315aa0e5b74","observation_id":"819bd0a4-46c5-4350-af74-4e54a6d3fd83","resolution":{"observed_at":"2026-08-06T16:56:26.926652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:26.478418Z","title":"Asam: Adaptive sharpness- aware minimization for scale-invariant learning of deep neural networks","venue":null,"work_id":"9492ea45-b5c3-452c-b977-2f94485d447b","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.651391Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:39ad5473a37723fe76c64b6de0bd2b675e612ab23c0e9bbd64c621dbc268ccd6","observation_id":"63676b0b-fc29-4d39-8843-a0624f97ee0a","resolution":{"observed_at":"2026-08-06T16:56:26.601834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00246","last_updated":"2024-10-05T00:41:30Z","snapshot_observed_at":"2026-08-09T17:21:57.449710Z","submitted_at":"2023-11-30T23:24:45Z","title":"Directions of Curvature as an Explanation for Loss of Plasticity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00246","snapshot_observed_at":"2026-08-06T16:56:21.655160Z","title":"Directions of curvature as an explanation for loss of plasticity","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.655160Z"},"links":{"cited_paper":"/paper/2312.00246","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:bb62f9ade475a721f9f73b876e40a7aaea628e138e11066a211ed54cdb3e0652","observation_id":"2aa990dd-260d-4548-ac0f-1101d963f5c6","resolution":{"observed_at":"2026-08-06T16:56:21.655160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.658641Z","title":"Visualizing the loss landscape of neural nets","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.658641Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:8deb97a38ea762f3ce9b2965a48b99e586ef89ca18e651402d96a8d5ea82e359","observation_id":"adc807cc-fcd1-4d0e-a0a9-53bb9be0348c","resolution":{"observed_at":"2026-08-06T16:56:21.658641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11704-016-6903-6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Lifelong machine learning: a paradigm for continuous learning","venue":"Frontiers of Computer Science","work_id":"a5ca7b9c-868b-4f3c-8e78-3cf3a4524d20","year":2017},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.662211Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:8354719649b99fd6f94b166ed7c33a4e12696e3fb29a60fb4a73ead55daaade4","observation_id":"7fd628e2-70aa-47bf-9edf-94d1570dffcf","resolution":{"observed_at":"2026-08-06T16:56:21.855586Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:26.256895Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"4551fb9a-d176-48b8-97c7-c09a92a30535","year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.665480Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:dffb14bfe765e7e11a3d0ef248b7e5f6acac5decee9d7cb110f9cf9fde6dbb9e","observation_id":"913c656a-b05d-4b2f-91cf-253cc678ab29","resolution":{"observed_at":"2026-08-06T16:56:26.384343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:26.060587Z","title":"Understanding and preventing capacity loss in reinforcement learning","venue":null,"work_id":"065abd47-7b7f-4c37-ac96-b63e6b080d2d","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.669910Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:1fb1773293f74203ad0e6933f554bb7f1f88fa769132400501a081a89c7c0c3f","observation_id":"17701754-01ef-4999-b64c-6710e8f1b639","resolution":{"observed_at":"2026-08-06T16:56:26.153675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01800","last_updated":"2024-07-01T20:58:01Z","snapshot_observed_at":"2026-08-09T13:47:24.153200Z","submitted_at":"2024-07-01T20:58:01Z","title":"Normalization and effective learning rates in reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01800","snapshot_observed_at":"2026-08-06T16:56:21.673962Z","title":"Normalization and effective learning rates in reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.673962Z"},"links":{"cited_paper":"/paper/2407.01800","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:a1ee78fc4a42ea7f9d6de71d5cf9d5c92beaf43a71c8cd9fa9d18d2c5e338d37","observation_id":"630a4362-d18f-413f-b6a6-adf0362d1db5","resolution":{"observed_at":"2026-08-06T16:56:21.673962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:25.934177Z","title":"Deep learning via hessian-free optimization","venue":null,"work_id":"da1dce6f-2d2b-4445-9c5a-edfe7a00df7d","year":2010},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.678241Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:1563978fe0265e2bae3c719934ace9964d5c9c7363a64f4499b1bb9fa5bef5c7","observation_id":"d6fa2383-3b1f-46e4-992d-8a1fb0ec6dd6","resolution":{"observed_at":"2026-08-06T16:56:25.989876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:25.759632Z","title":"Optimizing neural networks with kronecker-factored approximate curvature","venue":null,"work_id":"6ed1b0e1-d436-49a7-bff4-49016fd9c808","year":2015},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.682177Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:1d1c5216bb4749f856b99b775d9b8f111b156548faf4dc803232e28d573ed8d6","observation_id":"5af0d7bc-5368-4437-852f-fb5568339785","resolution":{"observed_at":"2026-08-06T16:56:25.854507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:25.565491Z","title":"A logical calculus of ideas immanent in nervous activity","venue":null,"work_id":"2793facf-9059-4a95-b9a1-94f0175d7e36","year":1943},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.685963Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:ee4f71a8b46e0c89a8f4cb460e3faa6e69ab4b3694de5c1def72cce589b999cb","observation_id":"caf21fdf-cd44-4892-81fc-b19b2cc60d3c","resolution":{"observed_at":"2026-08-06T16:56:25.654686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.690306Z","title":"Minsky and S","venue":null,"work_id":null,"year":1969},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.690306Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:adee0fbc7ba213b89000d9ff68e957b7e17e1ff02a3291e5b8ce7003a7de8bc6","observation_id":"82978154-a992-458c-a17e-dc9b852ae374","resolution":{"observed_at":"2026-08-06T16:56:21.690306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02292","last_updated":"2019-12-04T22:47:31Z","snapshot_observed_at":"2026-07-06T08:42:09.483153Z","submitted_at":"2019-12-04T22:47:31Z","title":"Deep Double Descent: Where Bigger Models and More Data Hurt","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02292","snapshot_observed_at":"2026-08-06T16:56:21.695553Z","title":"Deep double descent: Where bigger models and more data hurt","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.695553Z"},"links":{"cited_paper":"/paper/1912.02292","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:9cb89985330cbe30eff8430d79501592cd495036453cad96b939ff62f1081978","observation_id":"970ae01c-cc50-475c-bf09-adef742c8997","resolution":{"observed_at":"2026-08-06T16:56:21.695553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06807","last_updated":"2015-11-21T01:11:29Z","snapshot_observed_at":"2026-07-06T04:37:18.887121Z","submitted_at":"2015-11-21T01:11:29Z","title":"Adding Gradient Noise Improves Learning for Very Deep Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06807","snapshot_observed_at":"2026-08-06T16:56:21.702106Z","title":"Le, Ilya Sutskever, Lukasz Kaiser, Karol Kurach, and James Martens","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.702106Z"},"links":{"cited_paper":"/paper/1511.06807","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:4eb11adeb90bf6220eeaaf9b960d605f369212952fb521c2c0584cc3a0bd5577","observation_id":"cea9d834-c83b-450e-8b08-1d6be0821226","resolution":{"observed_at":"2026-08-06T16:56:21.702106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:25.358138Z","title":"Nerem, Samantha Chen, Sanjoy Dasgupta, and Yusu Wang","venue":null,"work_id":"c3f8c5db-5a2d-45eb-8649-7f632516bc3e","year":2025},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.706811Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:c15597b0d3a443687327b3f43973cf1547e55a4277b02ef439d54f58c10cf2b9","observation_id":"01faa2ae-dc30-4a2b-87ba-cd6e7f7ea44f","resolution":{"observed_at":"2026-08-06T16:56:25.453270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:25.188371Z","title":"The role of over-parametrization in generalization of neural networks","venue":null,"work_id":"43b94e63-d27c-4044-a430-5c22fc445c24","year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.711669Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:5de2946f947a09f9b37c1ff20fd666c3708064c3058d6a0bb7ac21dec92d4722","observation_id":"e9fd9b8b-fbad-451d-9a91-2826cd7e9c6d","resolution":{"observed_at":"2026-08-06T16:56:25.287275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:24.987999Z","title":"The primacy bias in deep reinforcement learning","venue":null,"work_id":"95f088d5-c16c-435e-af7e-f6e904b5d372","year":2022},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.716896Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:1614e6fa934f5a0dd820b4c38ac4fe1e51fae94ff8cc63fb615ca152e475e45a","observation_id":"14ad059f-ef90-43f4-9999-33d25112112b","resolution":{"observed_at":"2026-08-06T16:56:25.084726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:24.789391Z","title":null,"venue":null,"work_id":"b3f8aeb0-8d2c-41d3-8416-8782fcc17d58","year":2006},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.720672Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:58e7850129a930f8f971119dc3bb910cf01cb0c03b28b80288c605ca605a598a","observation_id":"2af4951e-ab45-44ef-9173-c56ed9f9879d","resolution":{"observed_at":"2026-08-06T16:56:24.884761Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.724002Z","title":"Parisi, Ronald Kemker, Jose L","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.724002Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:cab10a11dc60e0a96cac57555b9a155c69d95dc822414dab79bf2eb220b1f53c","observation_id":"8e907d35-ea9a-4bbd-9ef6-088c10674983","resolution":{"observed_at":"2026-08-06T16:56:21.724002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:24.588781Z","title":"On the difficulty of training recurrent neural networks","venue":null,"work_id":"66479e7a-ee3e-4888-9b0f-b01d1dc8156c","year":2013},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.729228Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:de289ac640805dcb1bf4e5fac5d79be2e569cbb6bee6bc78cfa00a74b6952f56","observation_id":"70c4ea2c-accf-4f09-a21d-989d6c64c7ec","resolution":{"observed_at":"2026-08-06T16:56:24.683654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:24.431728Z","title":"Attention is turing-complete","venue":null,"work_id":"8aa04025-3690-4e37-aed3-5ed5edf755c9","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.733132Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:819f720c217db22b176f67200764dd3e4fdde05428bc6b66a8e0b3496cf6e930","observation_id":"ba82417c-4173-43cb-94cc-50a52999137c","resolution":{"observed_at":"2026-08-06T16:56:24.486896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.736663Z","title":"Rewarded soups: towards pareto-optimal alignment by interpolating weights fine-tuned on diverse rewards.Advances in Neural Information Processing Systems, 36:71095–71134, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.736663Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:3da00ab518cf834d02d8efa91ddea1a39dcdd3adaf0d2d274c48a1e3831f809a","observation_id":"ccc01c0b-7d82-4986-9011-f4fb2b6bae0a","resolution":{"observed_at":"2026-08-06T16:56:21.736663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:24.223646Z","title":"Sparse feature learning for deep belief networks","venue":null,"work_id":"1255cfbe-0867-47f1-a679-1ede389250e0","year":2007},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.740365Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:ad6b37791c517e0dc37b705031501fa08aefc70585c6cec8c52f08bf14c3aecb","observation_id":"41fefeee-fcff-4ced-afe2-5453345380fe","resolution":{"observed_at":"2026-08-06T16:56:24.314260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:24.053668Z","title":"Catastrophic forgetting, rehearsal and pseudorehearsal","venue":null,"work_id":"382065b4-976d-451f-8408-71bd6fb60192","year":1995},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.745316Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:1616713470d4105b39292644e8a827a4d5000394a62fca5005e47f0273a5470c","observation_id":"2abcd8ad-7b84-4540-803b-2e23f22134c1","resolution":{"observed_at":"2026-08-06T16:56:24.150680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.749382Z","title":"Learning representations by back-propagating errors","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.749382Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:eac2586fb0d51a3781cb5f804d66820923dcd91bf0f078a426bbb7ffcaf3224c","observation_id":"d0787047-6e70-4db6-8cb5-1eb6f747225c","resolution":{"observed_at":"2026-08-06T16:56:21.749382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.00296","last_updated":"2021-10-06T13:22:57Z","snapshot_observed_at":"2026-08-05T08:54:18.350167Z","submitted_at":"2021-10-01T10:03:57Z","title":"Powerpropagation: A sparsity inducing weight reparameterisation","version":2},"cited_work":{"arxiv_id":"2110.00296","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.00296","snapshot_observed_at":"2026-08-06T16:56:22.355104Z","title":"Powerpropagation: A sparsity inducing weight reparameterisation","venue":"stat.ML","work_id":"7ebe5c2e-fc8c-43b2-acfd-25772f00fc18","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.753998Z"},"links":{"cited_paper":"/paper/2110.00296","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:5ff1f315e6302280d874e2edd58ed186288461cc63ac974bda58f9ad84d4577d","observation_id":"6d4b1a62-8a4b-4cd1-9609-d6012d52c572","resolution":{"observed_at":"2026-08-06T16:56:22.402190Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0385.13043","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:22.243190Z","title":"Siegelmann and Eduardo D","venue":null,"work_id":"30a28a70-2fe3-4bdd-a7d4-09191fad83ff","year":1992},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.758148Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:66af881ee074478201e0112187c9271a2ab60d96505358d5c039e1560a02c051","observation_id":"5d888c67-2052-4fc8-a5d2-9c29096aaf87","resolution":{"observed_at":"2026-08-06T16:56:22.315614Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.761700Z","title":"Mas- tering the game of go with deep neural networks and tree search","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.761700Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:a77545aaff41fdfe92f1c0ae11d5b78d945accb2829730cd3a6c8703cfe2a5c4","observation_id":"60bd0630-9ce9-4918-898c-aa2c69d96970","resolution":{"observed_at":"2026-08-06T16:56:21.761700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14340","last_updated":"2020-11-25T17:31:09Z","snapshot_observed_at":"2026-08-03T17:30:34.578889Z","submitted_at":"2020-04-29T17:14:23Z","title":"WoodFisher: Efficient Second-Order Approximation for Neural Network Compression","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14340","snapshot_observed_at":"2026-08-06T16:56:21.765182Z","title":"Woodfisher: Efficient second-order approximation for neural network compression, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.765182Z"},"links":{"cited_paper":"/paper/2004.14340","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:6d44f75eec597f40a45a014f08067551f2cc2988337bce4231cc96248fb51946","observation_id":"41cc8397-c1ef-4b93-9646-216a1161b522","resolution":{"observed_at":"2026-08-06T16:56:21.765182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:23.871832Z","title":"Smith, Benoit Dherin, David G","venue":null,"work_id":"0a6b1670-3d3a-4b2a-ad1b-4838ec07ff60","year":2021},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.768961Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:de158f258045bfaee6232c6769f9243af1a82db649f7c2ef976dfd39e0014dca","observation_id":"39c4365f-3c07-4803-b417-de3d7d4e2665","resolution":{"observed_at":"2026-08-06T16:56:23.935503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:23.677014Z","title":"The dormant neuron phenomenon in deep reinforcement learning","venue":null,"work_id":"59f68b04-a8f6-4627-8aad-35ae857ef059","year":2023},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.772384Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:3ef579e153e820adde11fbac487cbb09f213b509822408d3a29c6f2b37329c80","observation_id":"10454d02-8d6a-44cb-b5a3-6814fff80c8f","resolution":{"observed_at":"2026-08-06T16:56:23.767904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.28545","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:22.020263Z","title":null,"venue":null,"work_id":"70f1e9dd-1800-497c-a0b3-c41890c391ca","year":2019},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.776254Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:8ca72db5f230aa875095dd5039c64fa5183ec8cb61419d6e64a1e6cb7912b12c","observation_id":"ad3d97d5-c93b-44aa-89c3-64d736760e38","resolution":{"observed_at":"2026-08-06T16:56:22.072229Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/bf00992697","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:03:45.533247Z","title":"Practical issues in temporal difference learning","venue":"Machine Learning","work_id":"8c9f1b38-52cb-4410-b06c-569ec10632a8","year":1992},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.780085Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:ea7c36e0934d4b89fcc42d102352e6a277d3949f946dc03c3f471ff0fa0cda92","observation_id":"de7735b9-1187-464c-bb52-f47bd1ca6156","resolution":{"observed_at":"2026-08-06T16:56:21.830160Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:23.567386Z","title":"softmax is not enough (for sharp out-of-distribution), 2024","venue":null,"work_id":"0d71ef98-0e7e-4041-8fa2-e2ae5180567f","year":2024},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.784093Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:f25aade447f46508d26abbc116aebb4f40d846f4d18aaad609ccefe86536547d","observation_id":"2bdeb531-d658-48bc-84d6-22d574178a35","resolution":{"observed_at":"2026-08-06T16:56:23.620325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:23.422660Z","title":null,"venue":null,"work_id":"c95bacf3-469d-42f7-aba7-7eeaafd5436e","year":2022},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.787654Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:e15935c96ab198b18e47bf75f9e87298337cb8e3db2317cf667e38a24ce226e5","observation_id":"68a370e2-71c8-466f-a177-0ae4efb0e478","resolution":{"observed_at":"2026-08-06T16:56:23.476911Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:23.286416Z","title":"Lee, Edward Moroshko, Pedro Savarese, Itay Golan, Daniel Soudry, and Nathan Srebro","venue":null,"work_id":"a0f1d43b-5481-4bcf-80ba-173e9fadbe99","year":2020},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.791861Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:1387b3a98bc4d8b62a26e70af53950505a8a65da9c054ce16768444a38e2fa17","observation_id":"e2fdba17-1994-4f6a-8d86-50d22a5138f6","resolution":{"observed_at":"2026-08-06T16:56:23.367835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:23.187928Z","title":"Understanding deep learning requires rethinking generalization","venue":null,"work_id":"613ca959-55d7-48fd-a34e-65342e0f9d05","year":2017},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.795284Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:e01c78c58b8f4143fa8b18686dea31aa847887bb074e328f03c7dc18255ec58f","observation_id":"9d010b2b-867e-4758-8081-bdf40138134c","resolution":{"observed_at":"2026-08-06T16:56:23.232897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:56:21.618591Z","title":"doi: 10.1162/neco.1997.9.1.1","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":1997,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.618591Z"},"links":{"citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:d482a6749ac9b7779b5d6236eb1641a3d28d6ad063847263e7e50703e32b9ff0","observation_id":"d7fdcfc5-ba3f-4363-82b7-80dd833a5ddb","resolution":{"observed_at":"2026-08-06T16:56:21.618591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04345","last_updated":"2025-06-26T16:08:44Z","snapshot_observed_at":"2026-07-06T15:51:58.017259Z","submitted_at":"2023-07-10T05:06:41Z","title":"Continual Learning as Computationally Constrained Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04345","snapshot_observed_at":"2026-08-06T16:56:21.643315Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T16:56:21.643315Z"},"links":{"cited_paper":"/paper/2307.04345","citing_paper":"/paper/2507.12224"},"observation_digest":"sha256:891a204e635e424fc585770b60e668efd68ec909b86f07f713b24fd16412736d","observation_id":"c080a08e-0bfc-46c1-a6fa-cf97e8b436c5","resolution":{"observed_at":"2026-08-06T16:56:21.643315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.12224","last_updated":"2025-07-16T13:33:31Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T16:48:47.710572Z","submitted_at":"2025-07-16T13:33:31Z","title":"Optimizers Qualitatively Alter Solutions And We Should Leverage This"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":34,"verified_exact":6,"verified_fuzzy":38},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 7 inbound Pith citation observations for arXiv:2507.12224."}