{"as_of":"2026-08-15T05:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:86c03b1723aff660ee65cdde2930f57c401ce05c00bc6e620980c1641f4632b1","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T10:20:32.005290Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:32:06.484361Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:32:10.377062Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"cited_work":{"arxiv_id":"2412.16854","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.16854","snapshot_observed_at":"2026-08-07T12:32:10.377062Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","venue":"cs.LG","work_id":"96dd4505-c226-4c24-b179-5b31d5b34963","year":2024},"citing_paper":{"arxiv_id":"2505.24399","last_updated":"2025-05-30T09:28:38Z","snapshot_observed_at":"2026-08-15T05:31:32.419217Z","submitted_at":"2025-05-30T09:28:38Z","title":"LightSAM: Parameter-Agnostic Sharpness-Aware Minimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:06.484361Z"},"links":{"cited_paper":"/paper/2412.16854","citing_paper":"/paper/2505.24399"},"observation_digest":"sha256:3e7551fad9e47932aa5fca545c8f951d6e893180d3df79cf56a7ce8fde4dd833","observation_id":"ab012672-d34c-472e-98f9-ad6716cbbf86","resolution":{"observed_at":"2026-08-07T12:32:10.443643Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.16854/citation-record","integrity":"/paper/2412.16854/integrity","json":"/paper/2412.16854/citation-record.json","paper":"/paper/2412.16854"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.370741Z","title":"Adaptive regularization with cubics on manifolds","venue":null,"work_id":"7e397dd7-6e82-49e5-ab56-8dd07fe9b0ca","year":2021},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.912207Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:4b2047a490c1334909f6126d2c53db1ab06d05f4cfbacb07998807a6aa2d3a2a","observation_id":"6f898516-4b53-4da1-b482-e93e40f8baf0","resolution":{"observed_at":"2026-08-11T10:20:32.375324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.355850Z","title":"To- wards understanding sharpness-aware minimization","venue":null,"work_id":"fd5ca603-323d-4f54-9c0d-e402848f09cf","year":2022},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.916493Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:074431543f248aa011f0238aaf4ad1763dd26ee0f59a433b1f45720c1339b528","observation_id":"26b54dc2-7a68-4aaa-b6ec-3dcac239176e","resolution":{"observed_at":"2026-08-11T10:20:32.361467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.340556Z","title":"Stochastic analysis of an adaptive cubic regularization method under inexact gradient evaluations and dynamic hessian accu- racy","venue":null,"work_id":"86eab427-6a8d-4751-a9fd-617199ce2796","year":2022},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.920149Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:944420016b195be8e6385008b2323d23d7b2f72cc2d02fca1b786d1c09ee3f5a","observation_id":"2bc010f3-c479-4d51-ab4e-f6fa1a2144bf","resolution":{"observed_at":"2026-08-11T10:20:32.346168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.326966Z","title":"Opti- mization methods for large-scale machine learning","venue":null,"work_id":"245495a3-e762-494b-b161-0c5debde8dbe","year":2018},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.923814Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:0813c9c5e057c4b59d791e0dbeb9675755d755e53f2e2874d625bb76ff0c57e0","observation_id":"3f732cfd-1a1f-4cdb-949e-70d6f48f13ce","resolution":{"observed_at":"2026-08-11T10:20:32.331627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.312589Z","title":null,"venue":null,"work_id":"e37cc592-9513-402c-99c3-77005387055c","year":2022},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.927607Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:22561650fd9387793db27db055239dda8f695a6f158bc75297374f5bb85a8552","observation_id":"40cff607-9e95-4234-b1af-1197415105dc","resolution":{"observed_at":"2026-08-11T10:20:32.317081Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.300298Z","title":"Sharpness-aware minimization for efficiently improving generalization","venue":null,"work_id":"cd456184-b6da-4c90-b0f7-6b2c5690e135","year":2021},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.931378Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:41d54e3f6c5fb88430e78871b6933078947aa647e65d0b9b3c7b42a03ed591fa","observation_id":"bd274ac9-a97d-4a53-8fb6-bac3306abcc7","resolution":{"observed_at":"2026-08-11T10:20:32.304095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.288045Z","title":"Understanding the role of momentum in stochas- tic gradient methods","venue":null,"work_id":"7ef12f50-2343-4605-8fdd-85a0e04f4237","year":2019},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.935326Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:5e940fbaad6590229b8d225c0e7dbb4e2eda92df721af7e63cfb6582e68020a6","observation_id":"24f3da99-4886-4248-8fa3-bdbfc32ce352","resolution":{"observed_at":"2026-08-11T10:20:32.292401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:31.939573Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.939573Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:17d03c663ca20009f5f3aceae334d8d337e3d5cf48cd4e63887fa70109ea5870","observation_id":"c3c0b375-e7ae-4ae8-afd9-60b20206de4c","resolution":{"observed_at":"2026-08-11T10:20:31.939573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.269883Z","title":"Fantastic generalization measures and where to find them","venue":null,"work_id":"c8f6e354-3fc3-4661-815e-d38212217546","year":2020},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.943782Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:3477a939a195275b75690d96749ee58614d5a2051fb14e7d30ab52b6d7eccb79","observation_id":"eb84e23b-6a02-4f4e-9ee7-ef63ae4b32a0","resolution":{"observed_at":"2026-08-11T10:20:32.273567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.259306Z","title":"On large-batch training for deep learning: Generalization gap and sharp minima","venue":null,"work_id":"a792a996-303d-46cd-9194-551f3e556ed2","year":2017},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.947465Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:5ee5a58626d4b954300f44a197d52a181fd2239269740674228475e0edf3c8f7","observation_id":"c92bf434-3cb6-44da-b30e-50b19ecada3f","resolution":{"observed_at":"2026-08-11T10:20:32.262894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08060","last_updated":"2024-10-20T01:33:41Z","snapshot_observed_at":"2026-08-14T06:51:48.604917Z","submitted_at":"2024-01-16T02:37:23Z","title":"Fundamental Convergence Analysis of Sharpness-Aware Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08060","snapshot_observed_at":"2026-08-11T10:20:31.951325Z","title":"Fundamental convergence analysis of sharpness-aware minimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.951325Z"},"links":{"cited_paper":"/paper/2401.08060","citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:c69d39f676113906fccc3c282c722b4d742381f91d5cde5febb53b24b39257df","observation_id":"1bb894df-d559-48ab-8f60-9606d57ff7bc","resolution":{"observed_at":"2026-08-11T10:20:31.951325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.248572Z","title":"Sub-sampled cubic regularization for non-convex optimization","venue":null,"work_id":"0fe1c418-ba6b-4646-9c57-affd0edfacc5","year":1904},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.955828Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:aac7657fcb525c98ba590ea0008ffb6e83fb204257bd85a9d6ca9a96e3620671","observation_id":"be592894-de9b-41b8-a350-75f12ec42aec","resolution":{"observed_at":"2026-08-11T10:20:32.252523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.235883Z","title":"Asam: Adaptive sharpness-aware min- imization for scale-invariant learning of deep neural networks","venue":null,"work_id":"0fa36a04-128c-43b7-a3f5-502de45377a6","year":2021},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.960046Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:7f5e4b4a83b69c6f1aacbec8b131ce819ecdd1a39c02346bef12cabf28d76d81","observation_id":"d0beaf03-1ded-4ec0-a98c-7f7677f4b1a4","resolution":{"observed_at":"2026-08-11T10:20:32.240526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.224588Z","title":"Giannakis","venue":null,"work_id":"458f036d-42fc-4884-9153-624bc53a5147","year":2023},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.963945Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:45f543ae6aaf77d1e0b768f0be1a57f681f2eeb2330da1a13a725af132bd9840","observation_id":"7519dd12-06c5-416f-8185-480e501ff804","resolution":{"observed_at":"2026-08-11T10:20:32.228256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.211749Z","title":"Friendly sharpness-aware minimization","venue":null,"work_id":"48ce4b30-77a8-4ccb-9f19-58a2d7251d08","year":2024},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.967542Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:595e433f80828f6a16bc2908aa6d89c88656d9a92745f252858ae3820488065a","observation_id":"95230a08-8dfa-4d6e-9be7-4a8983f28d6c","resolution":{"observed_at":"2026-08-11T10:20:32.216957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.188951Z","title":"A second look at exponential and cosine step sizes: Simplicity, adaptivity, and performance","venue":null,"work_id":"571b4f4e-5254-4857-b598-363c22039365","year":2021},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.971305Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:f6173cd6b8153319f18c0849e77f804401e89bb10c9a7ece1c08d72a8f00ca6c","observation_id":"7b9bca27-3cff-4c7c-9630-eee894d1d20c","resolution":{"observed_at":"2026-08-11T10:20:32.193661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.176995Z","title":"Towards efficient and scalable sharpness- aware minimization","venue":null,"work_id":"5a35d257-619d-4af5-9874-0e903a747030","year":2022},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.975105Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:47831f313c12fdecd341eeafdc100003de75f30fa0bc064c4516c24da2579c7c","observation_id":"513477bc-5877-4d30-9b1c-4967507fa690","resolution":{"observed_at":"2026-08-11T10:20:32.181028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.158755Z","title":"Make sharpness- aware minimization stronger: A sparsified perturbation approach","venue":null,"work_id":"baba29ae-d160-4407-bbb3-92e0fe40a78b","year":2022},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.978966Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:78225ce305be748c6833eceb54bb5b33cdcb748397eefc0359309f0e58f43ecc","observation_id":"0e5b978f-f53a-4e90-8b56-58320f64454d","resolution":{"observed_at":"2026-08-11T10:20:32.167538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.144239Z","title":"Adasam: Boosting sharpness-aware minimization with adaptive learning rate and momentum for training deep neural networks","venue":null,"work_id":"ad55086a-a246-47a0-a1c3-0d2fd084cf67","year":2024},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.983216Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:185e4d62726829bbd0d7f425160d8cb1643582d5cf161bb5d1d760554468c121","observation_id":"bd22974f-cb28-4c98-9dfc-ab1a2a37e4d9","resolution":{"observed_at":"2026-08-11T10:20:32.148697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.130914Z","title":"Adaptive random walk gradient descent for decentralized optimiza- tion","venue":null,"work_id":"808f1f41-9722-469c-b59c-784cfbb8ded0","year":2022},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.986859Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:091032852db790ad9c0c7649f94579efa10390a97c6a255d19e94262cf6bb8d6","observation_id":"a9f5790d-aa5b-443c-8ee5-15d6ae6a1474","resolution":{"observed_at":"2026-08-11T10:20:32.135049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.09057","last_updated":"2021-10-18T07:03:48Z","snapshot_observed_at":"2026-08-13T17:50:52.700118Z","submitted_at":"2021-10-18T07:03:48Z","title":"Training Deep Neural Networks with Adaptive Momentum Inspired by the Quadratic Optimization","version":1},"cited_work":{"arxiv_id":"2110.09057","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.09057","snapshot_observed_at":"2026-08-11T10:20:32.054085Z","title":"Training Deep Neural Networks with Adaptive Momentum Inspired by the Quadratic Optimization","venue":"cs.LG","work_id":"72959bad-77a8-4d21-9b4e-d450c9b29a38","year":2021},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.990626Z"},"links":{"cited_paper":"/paper/2110.09057","citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:758d007801c90727b1d1051a43de8f450a9e04cc8cf3850bb8bc71a649608764","observation_id":"072c6cd5-7ced-40a1-9b2e-e18b90b2efdb","resolution":{"observed_at":"2026-08-11T10:20:32.061155Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.117975Z","title":"Novel convergence results of adaptive stochastic gradi- ent descents","venue":null,"work_id":"02b4e89f-ae6a-4a85-9e1d-07c355773b0b","year":2020},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.994611Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:26925b1e004224e899cb45b55fd6324ba65c073ff8ada42c1e199821db308d69","observation_id":"678d2c40-e0ec-468c-9a8f-77bc6ee769e7","resolution":{"observed_at":"2026-08-11T10:20:32.122097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.099276Z","title":"General proximal incremental aggregated gradient algo- rithms: Better and novel results under general scheme","venue":null,"work_id":"0bf7a5f2-3a43-42fc-8aa7-d4aeb418a453","year":2019},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:31.997863Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:966dc966101bfd99a08ba0ff9cc1619ab82d1fd14e8c156ac77cc187c7383315","observation_id":"522755ad-3f02-4708-8351-2fe59989ca29","resolution":{"observed_at":"2026-08-11T10:20:32.104600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:20:32.084686Z","title":"Normalized stochastic heavy ball with adaptive momentum","venue":null,"work_id":"28aeac27-f284-47aa-af7e-9b8c930321ad","year":2023},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:32.001407Z"},"links":{"citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:18bfae7c82523a1fa104e624ae644dbc634934d53e1def3d977c694b61762c89","observation_id":"a911a13d-aecc-4f63-8110-599d9f403150","resolution":{"observed_at":"2026-08-11T10:20:32.089647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1605.07146","last_updated":"2017-06-14T06:06:48Z","snapshot_observed_at":"2026-08-13T10:21:59.687060Z","submitted_at":"2016-05-23T19:27:13Z","title":"Wide Residual Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.07146","snapshot_observed_at":"2026-08-11T10:20:32.005290Z","title":"Wide residual networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:32.005290Z"},"links":{"cited_paper":"/paper/1605.07146","citing_paper":"/paper/2412.16854"},"observation_digest":"sha256:abd36e8edd7676dc7fae3b3c2f0c8e6bdc6aa026f6d7b1ae1cf063b9f67e065b","observation_id":"e1147683-b61a-434b-a8de-64b63ff08014","resolution":{"observed_at":"2026-08-11T10:20:32.005290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.16854","last_updated":"2024-12-22T04:40:02Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T06:52:15.766605Z","submitted_at":"2024-12-22T04:40:02Z","title":"Sharpness-Aware Minimization with Adaptive Regularization for Training Deep Neural Networks"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":20},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:2412.16854."}