{"as_of":"2026-08-09T22:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f25c9d24c4faebcf6545acbe26987437b7ca2dc6eb4527eefce55ce39dadff61","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T06:04:35.283217Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":16,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2408.00929","last_updated":"2026-04-21T23:34:26Z","snapshot_observed_at":"2026-07-06T18:55:49.577776Z","submitted_at":"2024-08-01T21:37:10Z","title":"Verification of Machine Unlearning is Fragile","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-23T22:23:43.259499Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2408.00929"},"observation_digest":"sha256:0edf3032d09b39f7cce4e5ed20f466ba35663d668bdd474bcb5aa45d40787e08","observation_id":"73ecdd2d-78b4-4ff4-8022-25482c219537","resolution":{"observed_at":"2026-05-23T22:25:50.536454Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-07T06:04:35.283217Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.06606","last_updated":"2025-06-07T00:47:07Z","snapshot_observed_at":"2026-08-09T18:41:53.384740Z","submitted_at":"2025-06-07T00:47:07Z","title":"Stacey: Promoting Stochastic Steepest Descent via Accelerated $\\ell_p$-Smooth Nonconvex Optimization","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T06:04:35.283217Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2506.06606"},"observation_digest":"sha256:4025747a59ba2cf7a1173674cc6cbc2979e1aadb46459d9d99cc74c2dac42fa1","observation_id":"6e0e1739-bfa8-4629-b538-6d058bbd41d2","resolution":{"observed_at":"2026-08-07T06:04:35.283217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-07T05:20:07.917254Z","title":"and Stich, S","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.08558","last_updated":"2025-06-11T06:46:49Z","snapshot_observed_at":"2026-08-07T05:04:57.822407Z","submitted_at":"2025-06-10T08:27:01Z","title":"Optimization over Sparse Support-Preserving Sets: Two-Step Projection with Global Optimality Guarantees","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:20:07.917254Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2506.08558"},"observation_digest":"sha256:a4a823c27a66a026cae0b891b76bba39d097c38fd3f0daf70856a49fd633b68d","observation_id":"dfd23108-f78d-4794-86c6-2cd50b394b1b","resolution":{"observed_at":"2026-08-07T05:20:07.917254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-06T10:19:08.874670Z","title":", Stich , S.U","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.00267","last_updated":"2025-08-01T02:22:03Z","snapshot_observed_at":"2026-08-09T16:41:25.863752Z","submitted_at":"2025-08-01T02:22:03Z","title":"Neighbor-Sampling Based Momentum Stochastic Methods for Training Graph Neural Networks","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T10:19:08.874670Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2508.00267"},"observation_digest":"sha256:56d482158b691214d454dadc96570e20d1cc746875442aba5397020cd390c406","observation_id":"67f6aa36-8aab-41fc-bc17-6767fa0759bb","resolution":{"observed_at":"2026-08-06T10:19:08.874670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-06T11:48:10.570043Z","title":"On the con- vergence of sgd with biased gradients","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2508.00922","last_updated":"2025-07-30T07:00:56Z","snapshot_observed_at":"2026-08-06T11:48:09.030082Z","submitted_at":"2025-07-30T07:00:56Z","title":"CaliMatch: Adaptive Calibration for Improving Safe Semi-supervised Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T11:48:10.570043Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2508.00922"},"observation_digest":"sha256:eb180e0ab77121b64d3fa7313ed4d4053b4f093657cf4a14a1426804724def09","observation_id":"711c965d-bef1-4183-9ddc-9ba52b79653f","resolution":{"observed_at":"2026-08-06T11:48:10.570043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-04T10:22:58.326295Z","title":"On the convergence of sgd with biased gradients","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2510.10854","last_updated":"2026-06-20T00:16:54Z","snapshot_observed_at":"2026-08-08T19:00:19.823910Z","submitted_at":"2025-10-12T23:33:46Z","title":"Discrete State Diffusion Models: A Sample Complexity Perspective","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T10:22:58.326295Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2510.10854"},"observation_digest":"sha256:c445faeb50f4cd97ba141727802ea4d5d1a2ec011ea3792d3c981b9827fba65b","observation_id":"25cf8e08-6015-46cf-89ba-dcf3c5b27c71","resolution":{"observed_at":"2026-08-04T10:22:58.326295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2604.15416","last_updated":"2026-04-16T17:55:36Z","snapshot_observed_at":"2026-07-06T23:02:58.361418Z","submitted_at":"2026-04-16T17:55:36Z","title":"StoSignSGD: Unbiased Structural Stochasticity Fixes SignSGD for Training Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T12:10:44.802059Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2604.15416"},"observation_digest":"sha256:9295e47f643701a237aaf361281f21fd02ea10fae75f3c13ffaa3dcf4f7bdbf9","observation_id":"9b4c3a94-5ba3-4c21-ac2e-9e7efd16f57b","resolution":{"observed_at":"2026-05-10T12:15:22.255624Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2605.05710","last_updated":"2026-05-07T05:55:10Z","snapshot_observed_at":"2026-07-06T23:18:17.333660Z","submitted_at":"2026-05-07T05:55:10Z","title":"On the Blessing of Pre-training in Weak-to-Strong Generalization","version":1},"reference_index":154,"source":"arxiv_source","source_observed_at":"2026-05-08T14:59:19.883399Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2605.05710"},"observation_digest":"sha256:9c8d24aa1f4bbda163707d7de692d89a9d7267320428a7fa84a58ef2f1dbf056","observation_id":"4f5cf886-a636-4217-bebb-29844a380db0","resolution":{"observed_at":"2026-05-11T18:36:08.560133Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2605.13434","last_updated":"2026-05-13T12:27:22Z","snapshot_observed_at":"2026-07-06T23:25:01.951546Z","submitted_at":"2026-05-13T12:27:22Z","title":"Rescaled Asynchronous SGD: Optimal Distributed Optimization under Data and System Heterogeneity","version":1},"reference_index":217,"source":"arxiv_source","source_observed_at":"2026-05-14T19:31:12.149482Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2605.13434"},"observation_digest":"sha256:6ef9355aaf064c40c85cb20fbcc9ce18bf7b199152585027c791241bacf1af30","observation_id":"8ceee93d-0ad8-47b1-abff-523ec59e9f39","resolution":{"observed_at":"2026-05-14T19:32:52.147043Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2605.16520","last_updated":"2026-05-15T18:14:38Z","snapshot_observed_at":"2026-08-08T04:03:57.471199Z","submitted_at":"2026-05-15T18:14:38Z","title":"Global Convergence of Sampling-Based Nonconvex Optimization through Diffusion-Style Smoothing","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-20T20:15:44.030714Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2605.16520"},"observation_digest":"sha256:dc6b58fd0888ba7e553e2169fb87eb141ee95099525016e12a90473cda001bf0","observation_id":"796735df-e8c1-493c-b227-b00dfd44dc5d","resolution":{"observed_at":"2026-05-20T20:18:59.256024Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2605.16690","last_updated":"2026-05-15T23:06:59Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:06:59Z","title":"UB-SMoE: Universally Balanced Sparse Mixture-of-Experts for Resource-adaptive Federated Fine-tuning of Foundation Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-20T19:06:08.951475Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2605.16690"},"observation_digest":"sha256:bcedfb79f1a64fcfd857d9f916ad84fc9ccc0cc6cd9b27abe2ca4bdb87f13c3d","observation_id":"a58217d0-0695-421a-92ab-0f69610fc47d","resolution":{"observed_at":"2026-05-20T19:08:54.375386Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2605.16875","last_updated":"2026-07-08T09:40:22Z","snapshot_observed_at":"2026-08-03T04:07:31.916506Z","submitted_at":"2026-05-16T08:36:29Z","title":"Stochastic Optimization and Data Science","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-19T21:08:29.524132Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2605.16875"},"observation_digest":"sha256:fa94906968d2a278b5022058522e5ff04e8a2170b09593646f3a6bcb7d04a124","observation_id":"843f7646-f85f-4356-8961-45b019d135fe","resolution":{"observed_at":"2026-05-19T21:12:47.227680Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-07-12T16:40:49.519929Z","title":"Robbins and S","venue":null,"work_id":null,"year":1951},"citing_paper":{"arxiv_id":"2605.16875","last_updated":"2026-07-08T09:40:22Z","snapshot_observed_at":"2026-08-03T04:07:31.916506Z","submitted_at":"2026-05-16T08:36:29Z","title":"Stochastic Optimization and Data Science","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-12T16:40:49.519929Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2605.16875"},"observation_digest":"sha256:e45055ed2e00481775173cb336c66573371d1c1a583edaf798bd144808f346e1","observation_id":"c5a8bdf2-af6e-408a-a38e-6fd17556d123","resolution":{"observed_at":"2026-07-12T16:40:49.519929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2606.18463","last_updated":"2026-06-16T20:14:34Z","snapshot_observed_at":"2026-08-08T05:34:50.731889Z","submitted_at":"2026-06-16T20:14:34Z","title":"Mixed-Precision Communication-Avoiding SGD for Generalized Linear Models on GPUs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T22:21:58.012861Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2606.18463"},"observation_digest":"sha256:65ba4fbc65d6840ba27f1d86d831d7da4f945be4f6307b6493c52d12ac8f7013","observation_id":"f28ef943-bea4-46e6-9944-8d42086d75aa","resolution":{"observed_at":"2026-07-03T23:29:02.055139Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":"2008.00051","doi":"10.48550/arxiv.2008.00051","metadata_source":"arxiv_reference","pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Stich, S","venue":"arXiv (Cornell University)","work_id":"058e05a0-2926-4e9a-ac32-aaf38f06aa5f","year":2008},"citing_paper":{"arxiv_id":"2606.20606","last_updated":"2026-05-21T21:32:19Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-05-21T21:32:19Z","title":"Distributed Quantum Learning over Near-term Devices: Convergence Analysis and Security Design","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T15:57:55.491466Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2606.20606"},"observation_digest":"sha256:cc83a875ddc5382c9a61b262afb607ddbb0b4899a1281e7b339bb2ee87e7bf6d","observation_id":"abf2c709-16ec-4e16-af25-96b0a78bf770","resolution":{"observed_at":"2026-06-30T16:04:53.055841Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:18.877967+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00051","snapshot_observed_at":"2026-07-11T23:22:05.432957Z","title":"On the convergence of SGD with biased gradients.arXiv preprint arXiv:2008.00051,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.03871","last_updated":"2026-07-04T13:26:21Z","snapshot_observed_at":"2026-08-08T10:59:08.410267Z","submitted_at":"2026-07-04T13:26:21Z","title":"A Gradient Flow Perspective on Minimum MMD Estimation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T23:22:05.432957Z"},"links":{"cited_paper":"/paper/2008.00051","citing_paper":"/paper/2607.03871"},"observation_digest":"sha256:afb4514bfb5ba64a3a675b3595709e0930b2d738f352ed36546b9cf44dc79681","observation_id":"2630799a-6d2d-4d12-833c-6656ad805507","resolution":{"observed_at":"2026-07-11T23:22:05.432957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2008.00051/citation-record","integrity":"/paper/2008.00051/integrity","json":"/paper/2008.00051/citation-record.json","paper":"/paper/2008.00051"},"outbound":[],"paper":{"arxiv_id":"2008.00051","last_updated":"2021-05-09T19:49:46Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T09:43:35.929296Z","submitted_at":"2020-07-31T19:37:59Z","title":"On the Convergence of SGD with Biased Gradients"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2008.00051."}