{"as_of":"2026-08-09T11:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:28b1f5c91ff06030ee03828c7c4ecc96b913f139b71f81380056a078913a4bd4","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:23:00.006822Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T09:15:44.217071Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1909.05350","last_updated":"2021-06-16T15:44:47Z","snapshot_observed_at":"2026-07-06T08:21:01.643474Z","submitted_at":"2019-09-11T20:54:49Z","title":"The Error-Feedback Framework: Better Rates for SGD with Delayed Gradients and Compressed Communication","version":2},"cited_work":{"arxiv_id":"1909.05350","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1909.05350","snapshot_observed_at":"2026-07-01T09:15:44.217071Z","title":"The error-feedback framework: Better rates for SGD with delayed gradients and compressed communication","venue":null,"work_id":"f33269a8-55af-4bee-a7e4-f34f00ad35c3","year":1909},"citing_paper":{"arxiv_id":"2003.00295","last_updated":"2021-09-08T23:37:17Z","snapshot_observed_at":"2026-07-06T09:01:12.515300Z","submitted_at":"2020-02-29T16:37:29Z","title":"Adaptive Federated Optimization","version":5},"reference_index":236,"source":"arxiv_source","source_observed_at":"2026-05-21T10:30:58.601351Z"},"links":{"cited_paper":"/paper/1909.05350","citing_paper":"/paper/2003.00295"},"observation_digest":"sha256:5c688e33e4dca52e8410b8524f8624ef2dca98befc8061e7d8d1fa10d682b0ea","observation_id":"60aee7e6-b320-4185-b253-e0318d1c87cb","resolution":{"observed_at":"2026-05-21T10:30:58.875788Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05350","last_updated":"2021-06-16T15:44:47Z","snapshot_observed_at":"2026-07-06T08:21:01.643474Z","submitted_at":"2019-09-11T20:54:49Z","title":"The Error-Feedback Framework: Better Rates for SGD with Delayed Gradients and Compressed Communication","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.05350","snapshot_observed_at":"2026-08-07T11:23:00.006822Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02879","last_updated":"2025-08-09T03:52:46Z","snapshot_observed_at":"2026-08-07T22:16:11.657224Z","submitted_at":"2025-06-03T13:46:15Z","title":"Distributed Retraction-Free and Communication-Efficient Optimization on the Stiefel Manifold","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:23:00.006822Z"},"links":{"cited_paper":"/paper/1909.05350","citing_paper":"/paper/2506.02879"},"observation_digest":"sha256:513f92c60e6bcee3c126eb3e185f62260f675a3ba81c733a2f45ecc52e40b6fe","observation_id":"d01f2260-b4a3-4298-a4dc-d75ea3d67942","resolution":{"observed_at":"2026-08-07T11:23:00.006822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05350","last_updated":"2021-06-16T15:44:47Z","snapshot_observed_at":"2026-07-06T08:21:01.643474Z","submitted_at":"2019-09-11T20:54:49Z","title":"The Error-Feedback Framework: Better Rates for SGD with Delayed Gradients and Compressed Communication","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.05350","snapshot_observed_at":"2026-08-06T21:47:45.531668Z","title":"The error- feedback framework: Better rates for SGD with delayed gradients and compressed communication","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.23516","last_updated":"2025-07-22T03:52:09Z","snapshot_observed_at":"2026-08-07T15:05:50.443227Z","submitted_at":"2025-06-30T04:46:25Z","title":"FedWSQ: Efficient Federated Learning with Weight Standardization and Distribution-Aware Non-Uniform Quantization","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:47:45.531668Z"},"links":{"cited_paper":"/paper/1909.05350","citing_paper":"/paper/2506.23516"},"observation_digest":"sha256:19de0012387bc08ba04f09ab3fa536ded15a054f05bb3fa4d0551c9f430bb765","observation_id":"af230635-95a5-4e9a-afb0-4988af3d0fd9","resolution":{"observed_at":"2026-08-06T21:47:45.531668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05350","last_updated":"2021-06-16T15:44:47Z","snapshot_observed_at":"2026-07-06T08:21:01.643474Z","submitted_at":"2019-09-11T20:54:49Z","title":"The Error-Feedback Framework: Better Rates for SGD with Delayed Gradients and Compressed Communication","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.05350","snapshot_observed_at":"2026-08-05T17:50:42.832022Z","title":"Benjamin Th´erien, Xiaolong Huang, Irina Rish, and Eugene Belilovsky","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2508.15706","last_updated":"2026-07-23T09:18:31Z","snapshot_observed_at":"2026-08-07T19:57:01.269382Z","submitted_at":"2025-08-21T16:48:19Z","title":"Overcoming the Communication-Performance Tradeoff in LLM Pretraining","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T17:50:42.832022Z"},"links":{"cited_paper":"/paper/1909.05350","citing_paper":"/paper/2508.15706"},"observation_digest":"sha256:7b51deaf2894c80e2676f5d19e2cd0fd5a6a6e4083694237664ba57150eb01ea","observation_id":"c7b2f858-94bd-43c9-aaa2-4f663a26e2d7","resolution":{"observed_at":"2026-08-05T17:50:42.832022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05350","last_updated":"2021-06-16T15:44:47Z","snapshot_observed_at":"2026-07-06T08:21:01.643474Z","submitted_at":"2019-09-11T20:54:49Z","title":"The Error-Feedback Framework: Better Rates for SGD with Delayed Gradients and Compressed Communication","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.05350","snapshot_observed_at":"2026-08-04T17:01:42.061587Z","title":"The error-feedback framework: Better rates for sgd with delayed gradients and compressed communication.arXiv preprint arXiv:1909.05350, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2509.11254","last_updated":"2025-09-14T12:54:28Z","snapshot_observed_at":"2026-08-08T08:32:27.730715Z","submitted_at":"2025-09-14T12:54:28Z","title":"From PowerSGD to PowerSGD+: Low-Rank Gradient Compression for Distributed Optimization with Convergence Guarantees","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T17:01:42.061587Z"},"links":{"cited_paper":"/paper/1909.05350","citing_paper":"/paper/2509.11254"},"observation_digest":"sha256:81f2a28478302a3d1e4f3a39874e30e8193d4a2d40aa101b7db2b6d003a7ae21","observation_id":"e65ccc3e-13ba-41a3-98b1-4059729db6ff","resolution":{"observed_at":"2026-08-04T17:01:42.061587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05350","last_updated":"2021-06-16T15:44:47Z","snapshot_observed_at":"2026-07-06T08:21:01.643474Z","submitted_at":"2019-09-11T20:54:49Z","title":"The Error-Feedback Framework: Better Rates for SGD with Delayed Gradients and Compressed Communication","version":2},"cited_work":{"arxiv_id":"1909.05350","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1909.05350","snapshot_observed_at":"2026-07-01T09:15:44.217071Z","title":"The error-feedback framework: Better rates for SGD with delayed gradients and compressed communication","venue":null,"work_id":"f33269a8-55af-4bee-a7e4-f34f00ad35c3","year":1909},"citing_paper":{"arxiv_id":"2604.24012","last_updated":"2026-06-09T08:27:40Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:47:50Z","title":"FedSLoP: Memory-Efficient Federated Learning with Low-Rank Gradient Projection","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T04:30:06.269559Z"},"links":{"cited_paper":"/paper/1909.05350","citing_paper":"/paper/2604.24012"},"observation_digest":"sha256:fd15b01bfa90d996a8cdecf67607bd16091ca4dad64601b55d804f499a6a69e2","observation_id":"e0e68c50-38ee-4881-9a7c-740053632c14","resolution":{"observed_at":"2026-05-11T21:46:18.381402Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05350","last_updated":"2021-06-16T15:44:47Z","snapshot_observed_at":"2026-07-06T08:21:01.643474Z","submitted_at":"2019-09-11T20:54:49Z","title":"The Error-Feedback Framework: Better Rates for SGD with Delayed Gradients and Compressed Communication","version":2},"cited_work":{"arxiv_id":"1909.05350","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1909.05350","snapshot_observed_at":"2026-07-01T09:15:44.217071Z","title":"The error-feedback framework: Better rates for SGD with delayed gradients and compressed communication","venue":null,"work_id":"f33269a8-55af-4bee-a7e4-f34f00ad35c3","year":1909},"citing_paper":{"arxiv_id":"2604.24012","last_updated":"2026-06-09T08:27:40Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:47:50Z","title":"FedSLoP: Memory-Efficient Federated Learning with Low-Rank Gradient Projection","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-01T09:10:20.045403Z"},"links":{"cited_paper":"/paper/1909.05350","citing_paper":"/paper/2604.24012"},"observation_digest":"sha256:8826c08f17b6b9f842b2e75d8b497cbcf9e4416b1152cdb5f6bdc44c8f7b6c37","observation_id":"813b6755-881d-4851-9dff-ea22ac9a4196","resolution":{"observed_at":"2026-07-01T09:15:44.220254Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05350","last_updated":"2021-06-16T15:44:47Z","snapshot_observed_at":"2026-07-06T08:21:01.643474Z","submitted_at":"2019-09-11T20:54:49Z","title":"The Error-Feedback Framework: Better Rates for SGD with Delayed Gradients and Compressed Communication","version":2},"cited_work":{"arxiv_id":"1909.05350","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1909.05350","snapshot_observed_at":"2026-07-01T09:15:44.217071Z","title":"The error-feedback framework: Better rates for SGD with delayed gradients and compressed communication","venue":null,"work_id":"f33269a8-55af-4bee-a7e4-f34f00ad35c3","year":1909},"citing_paper":{"arxiv_id":"2604.25467","last_updated":"2026-04-28T10:12:57Z","snapshot_observed_at":"2026-07-06T23:11:21.433834Z","submitted_at":"2026-04-28T10:12:57Z","title":"Subspace Optimization for Efficient Federated Learning under Heterogeneous Data","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-07T16:45:53.627922Z"},"links":{"cited_paper":"/paper/1909.05350","citing_paper":"/paper/2604.25467"},"observation_digest":"sha256:32e60cb855a689e1743eb5700c4bea984ca81e25192e0f009fe493c9ff969ee9","observation_id":"c1404fa7-e813-4c02-b35a-6ddb0f77a06d","resolution":{"observed_at":"2026-05-11T23:31:17.571077Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05350","last_updated":"2021-06-16T15:44:47Z","snapshot_observed_at":"2026-07-06T08:21:01.643474Z","submitted_at":"2019-09-11T20:54:49Z","title":"The Error-Feedback Framework: Better Rates for SGD with Delayed Gradients and Compressed Communication","version":2},"cited_work":{"arxiv_id":"1909.05350","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1909.05350","snapshot_observed_at":"2026-07-01T09:15:44.217071Z","title":"The error-feedback framework: Better rates for SGD with delayed gradients and compressed communication","venue":null,"work_id":"f33269a8-55af-4bee-a7e4-f34f00ad35c3","year":1909},"citing_paper":{"arxiv_id":"2605.13434","last_updated":"2026-05-13T12:27:22Z","snapshot_observed_at":"2026-07-06T23:25:01.951546Z","submitted_at":"2026-05-13T12:27:22Z","title":"Rescaled Asynchronous SGD: Optimal Distributed Optimization under Data and System Heterogeneity","version":1},"reference_index":221,"source":"arxiv_source","source_observed_at":"2026-05-14T19:31:12.149482Z"},"links":{"cited_paper":"/paper/1909.05350","citing_paper":"/paper/2605.13434"},"observation_digest":"sha256:eff5a6d428d00df993cfdb100632354e654b40e6b8000201f3a7d0a9f9dd2135","observation_id":"dda440a0-6c95-4889-9432-397664f16d92","resolution":{"observed_at":"2026-05-14T19:32:52.211932Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05350","last_updated":"2021-06-16T15:44:47Z","snapshot_observed_at":"2026-07-06T08:21:01.643474Z","submitted_at":"2019-09-11T20:54:49Z","title":"The Error-Feedback Framework: Better Rates for SGD with Delayed Gradients and Compressed Communication","version":2},"cited_work":{"arxiv_id":"1909.05350","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1909.05350","snapshot_observed_at":"2026-07-01T09:15:44.217071Z","title":"The error-feedback framework: Better rates for SGD with delayed gradients and compressed communication","venue":null,"work_id":"f33269a8-55af-4bee-a7e4-f34f00ad35c3","year":1909},"citing_paper":{"arxiv_id":"2606.30634","last_updated":"2026-06-29T17:57:50Z","snapshot_observed_at":"2026-08-08T07:12:14.083887Z","submitted_at":"2026-06-29T17:57:50Z","title":"One-Step Gradient Delay is Not a Barrier for Large-Scale Asynchronous Pipeline Parallel LLM Pretraining","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T06:41:55.732230Z"},"links":{"cited_paper":"/paper/1909.05350","citing_paper":"/paper/2606.30634"},"observation_digest":"sha256:720bd56304c82b0bd47a3cf818ee01395a8ff8b438a7e3cc9ffef33304c0ceae","observation_id":"328a2f7a-526a-4c88-a95f-77d01c28351a","resolution":{"observed_at":"2026-06-30T06:44:18.834840Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1909.05350/citation-record","integrity":"/paper/1909.05350/integrity","json":"/paper/1909.05350/citation-record.json","paper":"/paper/1909.05350"},"outbound":[],"paper":{"arxiv_id":"1909.05350","last_updated":"2021-06-16T15:44:47Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T08:21:01.643474Z","submitted_at":"2019-09-11T20:54:49Z","title":"The Error-Feedback Framework: Better Rates for SGD with Delayed Gradients and Compressed Communication"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:1909.05350."}