{"as_of":"2026-08-17T01:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b85318cfdf5dfc8539e697bd5227906ef5f15435611d48018c2bbf95b96c0cbb","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:59:57.163858Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03503/citation-record","integrity":"/paper/2509.03503/integrity","json":"/paper/2509.03503/citation-record.json","paper":"/paper/2509.03503"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2209.06302","last_updated":"2022-09-13T21:09:34Z","snapshot_observed_at":"2026-08-16T16:32:44.461088Z","submitted_at":"2022-09-13T21:09:34Z","title":"Optimization without Backpropagation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.06302","snapshot_observed_at":"2026-08-05T10:59:56.170025Z","title":"Optimization without backpropagation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-15T04:45:34.071306Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.170025Z"},"links":{"cited_paper":"/paper/2209.06302","citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:9fe60e086f49f7aa7512de4a7ff21c1f967ea3cdf823037c473e2ad767b83815","observation_id":"553782f1-621e-4dc0-9aab-f1cddcae824e","resolution":{"observed_at":"2026-08-05T10:59:56.170025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.32141","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:57.788626Z","title":"Cristiano Gratton, Naveen K","venue":null,"work_id":"c949b6c5-4d40-44d8-9d99-dcb51060a35c","year":2022},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-15T04:45:34.071306Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.363742Z"},"links":{"citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:ce11bdb45d89fd3f7a7e1dc6ab33fce3b1a2f3efb8890dbc97dc20c6b27b6235","observation_id":"b6cba81b-ae3e-47d7-9a37-b44f895ca68a","resolution":{"observed_at":"2026-08-05T10:59:57.881652Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.31392","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:57.574194Z","title":"Kaiming He, Xiangyu Zhang, Shaoqing Ren, and Jian Sun","venue":null,"work_id":"dfdbe5fe-dc3d-447a-9e44-e9d162aa1472","year":2021},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-15T04:45:34.071306Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.423984Z"},"links":{"citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:d62953ae060c9945c1b8f227525adeecde915c13801ed5809d9e0430819baaa6","observation_id":"634e1e70-bf53-42bd-a622-5bf6ff4daa37","resolution":{"observed_at":"2026-08-05T10:59:57.642043Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.05613","last_updated":"2021-09-12T21:06:07Z","snapshot_observed_at":"2026-08-16T17:57:11.639070Z","submitted_at":"2021-09-12T21:06:07Z","title":"Critical Learning Periods in Federated Learning","version":1},"cited_work":{"arxiv_id":"2109.05613","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.05613","snapshot_observed_at":"2026-08-05T10:59:57.335704Z","title":"Critical Learning Periods in Federated Learning","venue":"cs.LG","work_id":"ae277fd3-d928-48a5-b8d8-096402521d36","year":2021},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-15T04:45:34.071306Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.843424Z"},"links":{"cited_paper":"/paper/2109.05613","citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:387a59a98de0d285d50be0cee2fbb43d6a3d57d06e5daae162c85ed72e9f46a2","observation_id":"560da3f1-4c5b-400f-8ddb-f3a99df74fe2","resolution":{"observed_at":"2026-08-05T10:59:57.405315Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.00582","last_updated":"2022-07-21T12:33:15Z","snapshot_observed_at":"2026-08-15T04:44:38.370440Z","submitted_at":"2018-06-02T04:45:58Z","title":"Federated Learning with Non-IID Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.00582","snapshot_observed_at":"2026-08-05T10:59:56.953435Z","title":"Federated learning with non-iid data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-15T04:45:34.071306Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.953435Z"},"links":{"cited_paper":"/paper/1806.00582","citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:bad49628efbd98108f50d56a3af250f8d4f576fd757d89feeec8c5973ad8785e","observation_id":"92ca0ac0-8cfd-4018-a0f4-ad66b029595f","resolution":{"observed_at":"2026-08-05T10:59:56.953435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:58.179001Z","title":"The Rademacher distribution exhibits considerably lower variance and better overall accuracy than the Gaussian distribution","venue":null,"work_id":"2bd0d499-c1c7-48e0-9154-8653071979fc","year":2020},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-15T04:45:34.071306Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:57.163858Z"},"links":{"citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:8cfac5264c44432869061146f3c9836bb964685abb34d9e9af4e5674bd07a368","observation_id":"059722c0-de5f-48b2-8dfb-f0575400e967","resolution":{"observed_at":"2026-08-05T10:59:58.252085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:56.741954Z","title":"A Vaswani","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-15T04:45:34.071306Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":1992,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.741954Z"},"links":{"citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:24196cd59e7565f7c6c406ab46ec262136416760e7443eb8404899418e9f59ae","observation_id":"c06244c9-ddd9-4c71-97ba-b06d0d178b00","resolution":{"observed_at":"2026-08-05T10:59:56.741954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:58.491115Z","title":"cs.toronto.edu/˜kriz/learning-features-2009-TR.pdf","venue":null,"work_id":"ff2170d4-e05b-4081-afa1-0b6af0677dfb","year":2009},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-15T04:45:34.071306Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.502075Z"},"links":{"citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:f430d4025d1a48cc48a0efb8f0ff77d3ce62792bea6b76573afd5b2a21af9475","observation_id":"308c911d-e79b-4961-ae02-36b73d28eb36","resolution":{"observed_at":"2026-08-05T10:59:58.567079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12091","last_updated":"2024-11-02T07:41:54Z","snapshot_observed_at":"2026-08-16T14:33:24.322793Z","submitted_at":"2023-12-19T12:12:18Z","title":"A Survey on Model-heterogeneous Federated Learning: Problems, Methods, and Prospects","version":2},"cited_work":{"arxiv_id":"2312.12091","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.12091","snapshot_observed_at":"2026-08-05T10:59:57.997107Z","title":"A Survey on Model-heterogeneous Federated Learning: Problems, Methods, and Prospects","venue":"cs.DC","work_id":"7c604404-426d-42d6-bbcb-c0efded32dbd","year":2023},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-15T04:45:34.071306Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.297277Z"},"links":{"cited_paper":"/paper/2312.12091","citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:bbb13f52d3694d14b13104d112869c22b4b49825669be998f6234a84a5a3be0f","observation_id":"ff20ec9b-7256-4624-8176-23ad8325b2fe","resolution":{"observed_at":"2026-08-05T10:59:58.065420Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03751","last_updated":"2023-02-07T20:56:21Z","snapshot_observed_at":"2026-08-16T15:56:58.933498Z","submitted_at":"2023-02-07T20:56:21Z","title":"Understanding Why ViT Trains Badly on Small Datasets: An Intuitive Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03751","snapshot_observed_at":"2026-08-05T10:59:57.055832Z","title":"Understanding why vit trains badly on small datasets: An intuitive perspective","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-15T04:45:34.071306Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:57.055832Z"},"links":{"cited_paper":"/paper/2302.03751","citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:7cfcce3aac20d67937facda69c2958702856e885007751d541a1eb21cba3f70c","observation_id":"0158103e-9795-4759-885f-5fbc015ae4a9","resolution":{"observed_at":"2026-08-05T10:59:57.055832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:58.318908Z","title":"Zhong Long, Yuling Chen, Hui Dou, Yun Luo, Chaoyue Tan, and Yancheng Sun","venue":null,"work_id":"8cac632c-a64d-45b0-919f-5b776847b908","year":2023},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-15T04:45:34.071306Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.579770Z"},"links":{"citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:8dccc05c0b8d9075670664bad9ff6b529a667bc9811f78378cb25e50b01243b9","observation_id":"ded39750-3699-413d-942e-3d6148f3e185","resolution":{"observed_at":"2026-08-05T10:59:58.409231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.08819","last_updated":"2017-08-23T16:06:20Z","snapshot_observed_at":"2026-08-14T20:44:55.373539Z","submitted_at":"2017-07-27T11:22:22Z","title":"A Downsampled Variant of ImageNet as an Alternative to the CIFAR datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.08819","snapshot_observed_at":"2026-08-05T10:59:56.235507Z","title":"A downsampled variant of imagenet as an alternative to the cifar datasets","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-15T04:45:34.071306Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.235507Z"},"links":{"cited_paper":"/paper/1707.08819","citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:82d786755fb0e185d00b5e3fd4ed486dae497d265fda5e1a781fed2ddbe89797","observation_id":"69195c1a-e38f-43ff-8b31-9b081e54dad6","resolution":{"observed_at":"2026-08-05T10:59:56.235507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.02507","last_updated":"2022-08-04T07:37:07Z","snapshot_observed_at":"2026-08-16T16:41:15.782232Z","submitted_at":"2022-08-04T07:37:07Z","title":"ZeroFL: Efficient On-Device Training for Federated Learning with Local Sparsity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.02507","snapshot_observed_at":"2026-08-05T10:59:56.662419Z","title":"Zerofl: Efficient on-device training for federated learning with local sparsity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","snapshot_observed_at":"2026-08-15T04:45:34.071306Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:56.662419Z"},"links":{"cited_paper":"/paper/2208.02507","citing_paper":"/paper/2509.03503"},"observation_digest":"sha256:0cf68bdb4daa454b832ba03fd6071cb6a0374052313056607009cfbde7018be3","observation_id":"1424e056-fe05-4ebf-8095-88f9e974123e","resolution":{"observed_at":"2026-08-05T10:59:56.662419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.03503","last_updated":"2025-09-03T17:35:51Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T04:45:34.071306Z","submitted_at":"2025-09-03T17:35:51Z","title":"Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":6,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2509.03503."}