{"as_of":"2026-08-13T06:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:79997fc3ec55d6c9091f5a7285f9a7e2bb5310835b9b82d3aad68e6a3816225c","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:35:00.594186Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.10536/citation-record","integrity":"/paper/2507.10536/integrity","json":"/paper/2507.10536/citation-record.json","paper":"/paper/2507.10536"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:35:00.416500Z","title":"Brendan McMahan, Ilya Mironov, Kunal Talwar, and Li Zhang","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.416500Z"},"links":{"citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:e78f2c69ae287d7b9330eea5a41bcc8f2590ac5db7ec1fed79189249b3f84db0","observation_id":"a992f701-8020-40dc-8b91-8857adb02f3c","resolution":{"observed_at":"2026-08-06T17:35:00.416500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:35:00.805777Z","title":"Scalable sec- ond order optimization for deep learning, 2021","venue":null,"work_id":"ad65948c-afb8-4ae2-bf49-913e7e3ac625","year":2021},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.420787Z"},"links":{"citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:553db5f1824429248d7d3dadfb44e92f5216e2bcf26881bc7d768978d0ceb630","observation_id":"2e934b2d-0e85-4b31-9c3f-849976e802b3","resolution":{"observed_at":"2026-08-06T17:35:00.808225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-10T23:56:47.672054Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T17:35:00.426132Z","title":"Extracting training data from large language models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.426132Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:5a8cea3e08941b0bba93749cd519bffab4c6891828f292147225f6c63423f44c","observation_id":"77948df8-f2ae-4a6a-9eeb-3f0a4ab7d5c2","resolution":{"observed_at":"2026-08-06T17:35:00.426132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:35:00.798984Z","title":"Adaptive subgradient methods for online learning and stochastic optimization","venue":null,"work_id":"8125a3fb-dfeb-4071-96fa-561d3b8e499a","year":2011},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.441086Z"},"links":{"citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:3328ff16fc55f07af5cf76d8df797307d70393ada438eb5969eae9bf2b1c3977","observation_id":"1c2f29fd-3204-4f81-b0f3-ed1ae42bbcf6","resolution":{"observed_at":"2026-08-06T17:35:00.801586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-06T17:35:00.468978Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.468978Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:3f8952546f4c69abfa191d3badf7b7e9bcf3663c2d0cfa3395d46561a26226ca","observation_id":"9591ba3a-046d-4fdd-989b-9782a552fd3e","resolution":{"observed_at":"2026-08-06T17:35:00.468978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T17:35:00.483545Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.483545Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:e26cc9806593b1560e6180c2cfa196ca9b039fb3d661a4a4add08f759fa2a15f","observation_id":"1ad4f1b9-5674-4d76-91bc-8bebd22b79a5","resolution":{"observed_at":"2026-08-06T17:35:00.483545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13960","last_updated":"2023-04-27T05:41:13Z","snapshot_observed_at":"2026-08-02T07:55:35.655526Z","submitted_at":"2023-04-27T05:41:13Z","title":"Noise Is Not the Main Factor Behind the Gap Between SGD and Adam on Transformers, but Sign Descent Might Be","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13960","snapshot_observed_at":"2026-08-06T17:35:00.502564Z","title":"Noise is not the main factor behind the gap between sgd and adam on transformers, but sign descent might be, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.502564Z"},"links":{"cited_paper":"/paper/2304.13960","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:24258774d919e4aeb3325ffb36596bfa48a3af3833626d19ecb3babd6949a44f","observation_id":"c0083046-e54e-499b-8941-7fc4662516be","resolution":{"observed_at":"2026-08-06T17:35:00.502564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19449","last_updated":"2024-07-12T05:10:32Z","snapshot_observed_at":"2026-08-13T04:06:49.364574Z","submitted_at":"2024-02-29T18:47:52Z","title":"Heavy-Tailed Class Imbalance and Why Adam Outperforms Gradient Descent on Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19449","snapshot_observed_at":"2026-08-06T17:35:00.523005Z","title":"Heavy- tailed class imbalance and why adam outperforms gradient descent on language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.523005Z"},"links":{"cited_paper":"/paper/2402.19449","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:cf27c9141603cfc3dd686f92cb04c81a140ea8dcec4e03cc21f717b31551dd4d","observation_id":"804db7b2-bcdb-4899-85ca-a5638c30b740","resolution":{"observed_at":"2026-08-06T17:35:00.523005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08249","last_updated":"2023-10-01T18:34:20Z","snapshot_observed_at":"2026-08-07T23:54:19.429300Z","submitted_at":"2020-04-17T13:59:07Z","title":"Understanding the Difficulty of Training Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.08249","snapshot_observed_at":"2026-08-06T17:35:00.542162Z","title":"Understanding the difficulty of training transformers, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.542162Z"},"links":{"cited_paper":"/paper/2004.08249","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:b3c1986a34e5f2abaabfd97dd109e4024770ab456a6865d8afcf5a8923a353d3","observation_id":"6f731f1d-530c-464c-84b5-096da2279561","resolution":{"observed_at":"2026-08-06T17:35:00.542162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.05671","last_updated":"2020-06-08T01:28:58Z","snapshot_observed_at":"2026-08-09T23:10:59.294035Z","submitted_at":"2015-03-19T08:30:24Z","title":"Optimizing Neural Networks with Kronecker-factored Approximate Curvature","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.05671","snapshot_observed_at":"2026-08-06T17:35:00.556327Z","title":"Optimizing neural networks with kronecker-factored approx- imate curvature, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.556327Z"},"links":{"cited_paper":"/paper/1503.05671","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:074d3ce26444b430ee915d7c37f2a1e1a87567ad1c1d21e87d4c6feff36b73d1","observation_id":"d774b2d5-52cb-424f-847d-609911d2e59c","resolution":{"observed_at":"2026-08-06T17:35:00.556327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12506","last_updated":"2022-11-04T03:13:41Z","snapshot_observed_at":"2026-08-09T15:39:20.511535Z","submitted_at":"2022-05-25T05:49:31Z","title":"Memorization in NLP Fine-tuning Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12506","snapshot_observed_at":"2026-08-06T17:35:00.577638Z","title":"Memorization in nlp fine-tuning methods, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.577638Z"},"links":{"cited_paper":"/paper/2205.12506","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:e496ca569371f553920fd853a1ed8fe49024fc7904ff6d32f93c2cd7f6fda65b","observation_id":"120019b7-ce92-47c9-9947-8df7d4ec3ba9","resolution":{"observed_at":"2026-08-06T17:35:00.577638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.09254","last_updated":"2017-07-06T11:51:09Z","snapshot_observed_at":"2026-08-10T06:43:44.529765Z","submitted_at":"2017-06-28T12:38:53Z","title":"The E2E Dataset: New Challenges For End-to-End Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.09254","snapshot_observed_at":"2026-08-06T17:35:00.580123Z","title":"The e2e dataset: New challenges for end-to-end generation, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.580123Z"},"links":{"cited_paper":"/paper/1706.09254","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:18401cf08255a76e1e16ce4a203dc7255ed61ca6e4f4a4d2cda0f4d1d122ffe4","observation_id":"7d3e614e-c18c-4e5c-ba14-080fc4a61c8b","resolution":{"observed_at":"2026-08-06T17:35:00.580123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16382","last_updated":"2024-04-15T22:34:22Z","snapshot_observed_at":"2026-08-06T16:59:42.471139Z","submitted_at":"2023-07-31T03:17:51Z","title":"Does fine-tuning GPT-3 with the OpenAI API leak personally-identifiable information?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16382","snapshot_observed_at":"2026-08-06T17:35:00.582631Z","title":"Does fine-tuning gpt-3 with the openai api leak personally-identifiable information?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.582631Z"},"links":{"cited_paper":"/paper/2307.16382","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:b6469b8a3f1b090194b47a570a7248132aa09d96dc34944a254c4e767586936b","observation_id":"49d4fa1a-4059-4975-ba31-c28d13c79a9f","resolution":{"observed_at":"2026-08-06T17:35:00.582631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14334","last_updated":"2023-12-21T23:42:00Z","snapshot_observed_at":"2026-08-13T04:55:42.134415Z","submitted_at":"2023-12-21T23:42:00Z","title":"DP-AdamBC: Your DP-Adam Is Actually DP-SGD (Unless You Apply Bias Correction)","version":1},"cited_work":{"arxiv_id":"2312.14334","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.14334","snapshot_observed_at":"2026-08-06T17:35:00.637029Z","title":"DP-AdamBC: Your DP-Adam Is Actually DP-SGD (Unless You Apply Bias Correction)","venue":"cs.LG","work_id":"49ae6693-f118-4766-bef8-3935af457b51","year":2023},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.585245Z"},"links":{"cited_paper":"/paper/2312.14334","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:ffc88a57d04f763ee0877dbc2a3cf5d6ff00574bb4231485c0942ab7eb721cb5","observation_id":"54e0f782-48ec-430a-818a-6795c9ddcde4","resolution":{"observed_at":"2026-08-06T17:35:00.639766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12475","last_updated":"2023-05-21T14:40:43Z","snapshot_observed_at":"2026-08-10T12:10:46.184287Z","submitted_at":"2023-05-21T14:40:43Z","title":"Two Sides of One Coin: the Limits of Untuned SGD and the Power of Adaptive Methods","version":1},"cited_work":{"arxiv_id":"2305.12475","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.12475","snapshot_observed_at":"2026-08-06T17:35:00.625994Z","title":"Two Sides of One Coin: the Limits of Untuned SGD and the Power of Adaptive Methods","venue":"math.OC","work_id":"4686ec59-66c9-45d2-882c-2dfe0a8ac3fe","year":2023},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.587177Z"},"links":{"cited_paper":"/paper/2305.12475","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:57912f225bceeeb77501ca32fac3577cb6b1c0e346926e69025054c8461a2136","observation_id":"d2d3ba6f-77b1-4448-bdb3-b3e4e9eeb817","resolution":{"observed_at":"2026-08-06T17:35:00.630475Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06500","last_updated":"2022-07-14T22:14:17Z","snapshot_observed_at":"2026-08-10T09:37:42.752076Z","submitted_at":"2021-10-13T05:15:00Z","title":"Differentially Private Fine-tuning of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06500","snapshot_observed_at":"2026-08-06T17:35:00.589460Z","title":"Inan, Gautam Kamath, Janardhan Kulkarni, Yin Tat Lee, Andre Manoel, Lukas Wutschitz, Sergey Yekhanin, and Huishuai Zhang","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.589460Z"},"links":{"cited_paper":"/paper/2110.06500","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:d24561dbe4c91b9907f91038124e1e0f90c7ddd5a5113f9d53839b33b1fb7e87","observation_id":"db00a1ec-2ecd-4c95-a287-a58f604edc16","resolution":{"observed_at":"2026-08-06T17:35:00.589460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.03194","last_updated":"2020-10-23T08:07:04Z","snapshot_observed_at":"2026-08-12T10:44:42.012842Z","submitted_at":"2019-12-06T15:58:29Z","title":"Why are Adaptive Methods Good for Attention Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.03194","snapshot_observed_at":"2026-08-06T17:35:00.591858Z","title":"Why are adaptive methods good for attention models?, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.591858Z"},"links":{"cited_paper":"/paper/1912.03194","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:e27f5974efbccd81981c5907017bf2fded336ef38be42e7de641e1135c562674","observation_id":"0351a6d9-9cd4-48a8-8d70-89e37877fdaf","resolution":{"observed_at":"2026-08-06T17:35:00.591858Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:35:00.792370Z","title":null,"venue":null,"work_id":"78e35b0c-1a76-4c02-988b-675cfb386aa3","year":null},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.594186Z"},"links":{"citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:b1b61b5b771c74eaf155b1cc52927c9b0567bff7819a36cf2b89e9243cfdbf40","observation_id":"06846fe7-9227-4269-b8c9-42b55fc3c2ec","resolution":{"observed_at":"2026-08-06T17:35:00.794589Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T00:25:46.079436Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2507.10536."}