{"as_of":"2026-08-11T01:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9bb9e725ccfe0011c0a388ac2e30e029480ce1e73a4659c9b7c7693a8a7048ea","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T18:56:25.791922Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.10239/citation-record","integrity":"/paper/2502.10239/integrity","json":"/paper/2502.10239/citation-record.json","paper":"/paper/2502.10239"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:25.697842Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.697842Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:faa21947a1f69b8f4643069e8ca3ddc11f0347e605cdc0bb0a41aa849d7e1e29","observation_id":"a804e73d-6fa0-4549-8585-3b433f8d1a8c","resolution":{"observed_at":"2026-08-07T18:56:25.697842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.270418Z","title":"Fedrolex: Model-heterogeneous federated learning with rolling sub-model extraction","venue":null,"work_id":"28c1cb30-e61c-4450-8d72-3862872cb380","year":2022},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.702394Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:2b89c4bf51887176a95eed8fad2b003328b2f8166d449df785c0a1905d43d919","observation_id":"4afa8e17-0b37-47df-bcfc-14f804bdaeb5","resolution":{"observed_at":"2026-08-07T18:56:26.273343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.262548Z","title":"SL o RA : Federated parameter efficient fine-tuning of language models","venue":null,"work_id":"fba7ff9e-e597-4475-81ec-5ad50436df1b","year":2023},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.705894Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:ff412a1cf28234ba20d893f9c7e2a6ad5ea8b25ec9759c47445caca980c2fa46","observation_id":"baaaafbe-3cb9-4fa8-b0bd-5557c35acf55","resolution":{"observed_at":"2026-08-07T18:56:26.265334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.08587","last_updated":"2022-02-17T11:07:55Z","snapshot_observed_at":"2026-08-10T02:29:01.141729Z","submitted_at":"2022-02-17T11:07:55Z","title":"Gradients without Backpropagation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.08587","snapshot_observed_at":"2026-08-07T18:56:25.709239Z","title":"G., Pearlmutter, B","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.709239Z"},"links":{"cited_paper":"/paper/2202.08587","citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:4c2c192a1e5548ffaa147e0aba7dc890e1997061741346f8b66431f142f94efd","observation_id":"ca7f3293-642e-43ab-915e-7c7db1915219","resolution":{"observed_at":"2026-08-07T18:56:25.709239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:25.712904Z","title":"R., Angeli, G., Potts, C., and Manning, C","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.712904Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:47811ffba53a10e01688f41539da4961e8ab0e5d6050fdf3be84e72d04d0e412","observation_id":"c3c154d4-5c78-44e0-a9c5-9e1b15da5ec2","resolution":{"observed_at":"2026-08-07T18:56:25.712904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.253602Z","title":"A zeroth-order block coordinate descent algorithm for huge-scale black-box optimization","venue":null,"work_id":"95001638-1367-4d0a-8f89-40852825e34b","year":2021},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.716229Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:f11ef9d251234443aca8805ce2c4d99fd9dd304e7d3d3fa359ab7f12a3483164","observation_id":"b111fcc0-357b-497e-ab65-1fab460ac67b","resolution":{"observed_at":"2026-08-07T18:56:26.256666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.07210","last_updated":"2019-01-08T16:01:46Z","snapshot_observed_at":"2026-08-07T23:08:05.957777Z","submitted_at":"2018-12-18T07:31:18Z","title":"Expanding the Reach of Federated Learning by Reducing Client Resource Requirements","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.07210","snapshot_observed_at":"2026-08-07T18:56:25.719468Z","title":"B., and Talwalkar, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.719468Z"},"links":{"cited_paper":"/paper/1812.07210","citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:2c387e2732a4eab31eb8847969d04b4bf3e4862f854a4ef31daf2462a2cccd62","observation_id":"99c0d48f-f243-4c4c-8cd9-24a0b41acb8f","resolution":{"observed_at":"2026-08-07T18:56:25.719468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:25.723112Z","title":"B ool Q : Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.723112Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:48acfecf8989f8e213a4cf96dc4421fe2d85f5fc844305bd08e8ea3fdef468ff","observation_id":"112bf96f-f486-404d-99bd-479b88f844c8","resolution":{"observed_at":"2026-08-07T18:56:25.723112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.245207Z","title":"N., and Zhou, Y","venue":null,"work_id":"01dc037b-234a-4740-90bf-4087f1eabc0e","year":2022},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.725734Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:d3992fe9277e7ba15ea993399a416a1b8d83d01f41d8c092704ca3fc6a945896","observation_id":"99ba409e-2fa9-40fb-8625-d2138e26cbf5","resolution":{"observed_at":"2026-08-07T18:56:26.248034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12195","last_updated":"2024-07-21T11:01:00Z","snapshot_observed_at":"2026-08-01T19:26:12.995868Z","submitted_at":"2023-01-28T13:34:36Z","title":"BAFFLE: A Baseline of Backpropagation-Free Federated Learning","version":3},"cited_work":{"arxiv_id":"2301.12195","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.12195","snapshot_observed_at":"2026-08-07T18:56:26.083057Z","title":"BAFFLE: A Baseline of Backpropagation-Free Federated Learning","venue":"cs.LG","work_id":"f9899aad-d38f-415a-8ae3-c5a7cf9b9ae9","year":2023},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.728238Z"},"links":{"cited_paper":"/paper/2301.12195","citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:156a00bc10c9c21a951ede3f37338ea5e69a02f761219f0a44fa48e437d97cf3","observation_id":"83ae8fe5-4fdb-490a-ba51-17ec8c88d8c1","resolution":{"observed_at":"2026-08-07T18:56:26.086301Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.236123Z","title":"Making pre-trained language models better few-shot learners","venue":null,"work_id":"8bbe7b24-c929-4276-b49d-c9d1bc4f5846","year":2021},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.730951Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:df54ac0ea28edcda814876a454ae5609742ca76807b7cffba30046c0ad0916c7","observation_id":"ae4e5af4-3bae-48d6-8401-5fd62c6a89fd","resolution":{"observed_at":"2026-08-07T18:56:26.239619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.227140Z","title":"J., Shen, Y., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":"0da42e20-13a8-4544-acfd-d58bb2ed6dfa","year":2022},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.733575Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:21f2eb944ae2c1b15b9bf63a848e025ed32a58ad3abf28a75f48b0a55b990eb7","observation_id":"7ae281c4-0daf-4fd3-b02b-6b1b3b661666","resolution":{"observed_at":"2026-08-07T18:56:26.230551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:25.736092Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.736092Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:a035c9ab706307135fc3d932b6c86155064644eae3087014f8886c3c8e9f79e5","observation_id":"e76563ae-c4b3-41fc-996c-eef5fdc14266","resolution":{"observed_at":"2026-08-07T18:56:25.736092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15861","last_updated":"2025-06-02T23:58:41Z","snapshot_observed_at":"2026-07-06T18:19:33.945119Z","submitted_at":"2024-05-24T18:07:05Z","title":"Achieving Dimension-Free Communication in Federated Learning via Zeroth-Order Optimization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15861","snapshot_observed_at":"2026-08-07T18:56:25.738618Z","title":"Achieving dimension-free communication in federated learning via zeroth-order optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.738618Z"},"links":{"cited_paper":"/paper/2405.15861","citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:306f010a23ad13a8ab0ebe36046372b98963c24c49d7c15b595f8fcc7ec9e9b7","observation_id":"ec52d13b-8c53-41d3-909a-9585e84126d7","resolution":{"observed_at":"2026-08-07T18:56:25.738618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.218075Z","title":"On the convergence of zeroth-order federated tuning for large language models","venue":null,"work_id":"bb80593c-4211-4ebd-b0b6-1ece806e177c","year":2024},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.741331Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:388588758345729696edeecf2f2c15fbbb33e3ec3866b0ad38483186b5aaff65","observation_id":"0573a939-d2d1-484c-8668-af2af531dc9c","resolution":{"observed_at":"2026-08-07T18:56:26.221401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T18:56:25.744241Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.744241Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:0f515575aba73bc42463e61355af0944f95077cb406c6ec532afe985b2fd234b","observation_id":"542c8775-7e0d-4e58-8b0c-95110b477550","resolution":{"observed_at":"2026-08-07T18:56:25.744241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.208995Z","title":"D., Chen, D., and Arora, S","venue":null,"work_id":"b12562e7-0498-4bf2-89b3-b81014f86fa0","year":2023},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.748033Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:37d6cb5606182ae011dbe64991c45d65d134534aa0c7dc78e24516906c27ed29","observation_id":"22b1d21e-5e63-4a02-871c-eb11e623aa0a","resolution":{"observed_at":"2026-08-07T18:56:26.212047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:25.751311Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.751311Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:a933c3d62b32b18a9977a34a4d517e056215b31d75d46efebfffb5f710b2603e","observation_id":"f607d714-8a9d-40a5-8185-73e49022648f","resolution":{"observed_at":"2026-08-07T18:56:25.751311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.194161Z","title":"Black-box generalization: Stability of zeroth-order learning","venue":null,"work_id":"80f5f61e-da63-4dfa-9032-790c667c5751","year":2022},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.754547Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:2589d8485b3c2861d8eebf63a8b2dc55e33c138ed5a0a65322870db6b0944a9a","observation_id":"d515c248-a362-4a4e-8fee-20e8b908e014","resolution":{"observed_at":"2026-08-07T18:56:26.197495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15551","last_updated":"2024-10-22T13:32:59Z","snapshot_observed_at":"2026-08-03T13:03:28.655617Z","submitted_at":"2024-05-24T13:37:48Z","title":"Thinking Forward: Memory-Efficient Federated Finetuning of Language Models","version":2},"cited_work":{"arxiv_id":"2405.15551","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.15551","snapshot_observed_at":"2026-08-07T18:56:25.919701Z","title":"Thinking Forward: Memory-Efficient Federated Finetuning of Language Models","venue":"cs.LG","work_id":"ff9c503f-4420-4cfa-a768-0d1400cf3fc5","year":2024},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.758042Z"},"links":{"cited_paper":"/paper/2405.15551","citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:d933dad428ce14ce2d3e3093f9de54171c6400e8d178dd9fc8c326317990db26","observation_id":"7dd17cb2-150d-4f3d-bc22-38a21740f023","resolution":{"observed_at":"2026-08-07T18:56:25.923898Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.184346Z","title":"Aggregating capacity in fl through successive layer training for computationally-constrained devices","venue":null,"work_id":"151cf4df-4a11-46ff-bcfe-b4ed7d718104","year":2023},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.761967Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:f41ee2f7307204f5421296027490dce208dbb6a08cea3ffe71f2e836120cf819","observation_id":"6e039505-fcb6-47d0-a741-07a2fa020ae5","resolution":{"observed_at":"2026-08-07T18:56:26.187931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.174889Z","title":"Federated learning for computationally constrained heterogeneous devices: A survey","venue":null,"work_id":"8ad1ca3e-abcf-4387-a8c4-631b47653f1f","year":2023},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.765269Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:3d873a382116a5e96eb641f8c5804a1929ac17480a580ce0e355f526bfbef0d8","observation_id":"3433cf1c-7853-436b-830e-2d7fa4cee584","resolution":{"observed_at":"2026-08-07T18:56:26.178270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:25.768674Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.768674Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:c930a56620b67c6274913e026a40c94505016618068b9b5d86d4d9b719e4dbc5","observation_id":"19f6ef8b-e32f-496f-96e2-629da07d62bc","resolution":{"observed_at":"2026-08-07T18:56:25.768674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.163785Z","title":"Federated full-parameter tuning of billion-sized language models with communication cost under 18 kilobytes","venue":null,"work_id":"bb89acba-6d90-4dd3-81c7-b75eeb833362","year":2024},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.771856Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:e60a3eac7a2fc0cbc9d5fcae69a97ff5b651dff57c6f69393a6f9a80ea60d178","observation_id":"aafa219e-5b2c-492d-bd21-36e4b66055bb","resolution":{"observed_at":"2026-08-07T18:56:26.167833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.152702Z","title":null,"venue":null,"work_id":"402d1dbe-840d-4517-8d24-6d0669ffd270","year":2020},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.775068Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:c2b9d049c5419293fe630d38cbf81879f44a2418a92be38485e047cffd0a75e8","observation_id":"638aad1e-bdd0-4ef6-afca-80fca62c70cb","resolution":{"observed_at":"2026-08-07T18:56:26.156503Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:25.778192Z","title":"D., Ng, A","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.778192Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:d944ec566d35c6c568b14cd32ab47c8fb8cfb4768e222625cc45e9fcbdc2c6ee","observation_id":"567397c8-6538-4c19-90d5-9e3f9b55a08a","resolution":{"observed_at":"2026-08-07T18:56:25.778192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.134659Z","title":null,"venue":null,"work_id":"2d01c49d-9f75-4bbf-b2b0-da010f132516","year":1992},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.781567Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:33da799285883869c8bbe53fff1fdd6f3db9ebf2bd040c2b67378ca06228fa5d","observation_id":"3079c42e-094a-4f4a-a9a8-ef00d831b47a","resolution":{"observed_at":"2026-08-07T18:56:26.138569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02876","last_updated":"2020-01-31T05:36:19Z","snapshot_observed_at":"2026-08-09T15:28:05.141582Z","submitted_at":"2019-06-07T03:09:23Z","title":"Compressing RNNs for IoT devices by 15-38x using Kronecker Products","version":5},"cited_work":{"arxiv_id":"1906.02876","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.02876","snapshot_observed_at":"2026-08-07T18:56:25.903944Z","title":"Compressing RNNs for IoT devices by 15-38x using Kronecker Products","venue":"cs.LG","work_id":"1e502778-d683-43c4-a81b-9929b76d687e","year":2019},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.785505Z"},"links":{"cited_paper":"/paper/1906.02876","citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:7c84d4fb11c1410a76754111efd00a4d171b08c337f1c194521d3225640edf65","observation_id":"72a4e809-3c9b-4feb-9910-74cef78935f9","resolution":{"observed_at":"2026-08-07T18:56:25.909284Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.124223Z","title":"Progfed: effective, communication, and computation efficient federated learning by progressive training","venue":null,"work_id":"c6e7da50-4e47-42d9-a3bf-d6d1b6abbbfc","year":2022},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.788892Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:e56bc33a702a6a8ae06dea9e1d6a408a921fe095ea05e898795e85998cb5a48c","observation_id":"f2019943-4e9b-4a09-9902-960778133100","resolution":{"observed_at":"2026-08-07T18:56:26.127830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T18:56:26.113398Z","title":"FwdLLM : Efficient federated finetuning of large language models with perturbed inferences","venue":null,"work_id":"02684710-66cc-4c6c-a923-07ff84578c2b","year":2024},"citing_paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T18:56:25.791922Z"},"links":{"citing_paper":"/paper/2502.10239"},"observation_digest":"sha256:7351c0c5c72a53102b89409009444fb95969cd7eaf0b20419ca4440a6b5fd21a","observation_id":"9a8765f3-f07f-454d-8c6e-896dd2650a09","resolution":{"observed_at":"2026-08-07T18:56:26.117193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.10239","last_updated":"2026-06-16T22:55:19Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T14:39:38.116147Z","submitted_at":"2025-02-14T15:49:02Z","title":"Efficient Zeroth-Order Federated Finetuning of Language Models on Resource-Constrained Devices"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":3,"verified_fuzzy":14},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2502.10239."}