{"as_of":"2026-08-10T02:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:894647e06836014848d96cdf3d6984efe27d6d35b5a5603669f560ff5493ed66","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:06:19.639140Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:16:58.221358Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T14:26:03.697196Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"cited_work":{"arxiv_id":"2506.09034","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09034","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FZOO: Fast zeroth-order optimizer for fine-tuning large language models towards adam-scale speed","venue":null,"work_id":"3fd470e1-77a5-4e37-98b1-8e3a2a1da97b","year":2025},"citing_paper":{"arxiv_id":"2604.12968","last_updated":"2026-04-14T17:01:36Z","snapshot_observed_at":"2026-07-06T23:01:05.634599Z","submitted_at":"2026-04-14T17:01:36Z","title":"Evolution of Optimization Methods: Algorithms, Scenarios, and Evaluations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T15:16:58.221358Z"},"links":{"cited_paper":"/paper/2506.09034","citing_paper":"/paper/2604.12968"},"observation_digest":"sha256:336cdc8ab1aa7c53b42815935c339dd2dc7a870390076761400a1d550bac9f18","observation_id":"d6f94068-e7a9-4bf1-a44e-f5935d8d505e","resolution":{"observed_at":"2026-05-11T10:51:22.825954Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"cited_work":{"arxiv_id":"2506.09034","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09034","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FZOO: Fast zeroth-order optimizer for fine-tuning large language models towards adam-scale speed","venue":null,"work_id":"3fd470e1-77a5-4e37-98b1-8e3a2a1da97b","year":2025},"citing_paper":{"arxiv_id":"2604.21368","last_updated":"2026-04-23T07:31:29Z","snapshot_observed_at":"2026-07-06T23:07:56.487654Z","submitted_at":"2026-04-23T07:31:29Z","title":"Distributed Zeroth-Order Optimization with Rademacher Perturbations and Momentum Gradient Tracking","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-09T21:50:51.328565Z"},"links":{"cited_paper":"/paper/2506.09034","citing_paper":"/paper/2604.21368"},"observation_digest":"sha256:6a1804105745e7fed5fe3b5049516d49f92b13db16faad29e1b9400b167f7d72","observation_id":"348f4ee7-2357-450c-b00e-65ca7cc95f97","resolution":{"observed_at":"2026-05-11T14:26:03.699750Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09034/citation-record","integrity":"/paper/2506.09034/integrity","json":"/paper/2506.09034/citation-record.json","paper":"/paper/2506.09034"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.04497","last_updated":"2024-02-07T00:45:31Z","snapshot_observed_at":"2026-08-09T22:39:59.118786Z","submitted_at":"2024-02-07T00:45:31Z","title":"The Fine-Grained Complexity of Gradient Computation for Training Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04497","snapshot_observed_at":"2026-08-07T05:06:15.579083Z","title":"The fine-grained complexity of gradient computation for training large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:15.579083Z"},"links":{"cited_paper":"/paper/2402.04497","citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:1732a12880046b3039ec78c0827b963fc13befe3d9e0d71f91011c661a9bd5bc","observation_id":"401772d2-ad91-4c1b-82a0-9e5a72015bd3","resolution":{"observed_at":"2026-08-07T05:06:15.579083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:24.437125Z","title":"signsgd: Compressed optimisation for non-convex problems","venue":null,"work_id":"3d3f66a8-48e3-423c-ba70-41fe4be1d16c","year":2018},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:15.619963Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:b761b0521dcc17f7f2f6321759301d56492a96cf5cc87f45fde99b4890c36565","observation_id":"371edf7f-8291-43a8-9299-1556f74c61f4","resolution":{"observed_at":"2026-08-07T05:06:24.439673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:15.658824Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:15.658824Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:ef8f6754fb6d9ba3b61bb6cd3eb8c9035a7f268449a6d833cdee9bcced5a79a5","observation_id":"257d54c0-7a3c-46bd-909d-ec6cfe7e45d4","resolution":{"observed_at":"2026-08-07T05:06:15.658824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:24.426059Z","title":"A zeroth-order block coordinate descent algorithm for huge-scale black-box optimization","venue":null,"work_id":"1c1f8aa7-7454-4bc0-b4d3-5299490267aa","year":2021},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:15.687715Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:114181e9e86350a8796e0046bf911477f650f44284919e5cfe7b104319f4325e","observation_id":"11a945d9-6f45-4886-aab4-f0db33f689c5","resolution":{"observed_at":"2026-08-07T05:06:24.428456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:24.419471Z","title":"Towards efficient low-order hybrid optimizer for language model fine-tuning","venue":null,"work_id":"bf4c924b-08eb-413f-b235-79232451bb62","year":2025},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:15.733047Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:306a598992e1a6918a88142473324e27e04d0992658d634e8b0f5b9428b5f93d","observation_id":"7ef1d4ff-4feb-4b9f-a300-339966aaffcd","resolution":{"observed_at":"2026-08-07T05:06:24.421857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:24.412683Z","title":"Zoo: Zeroth order optimization based black-box attacks to deep neural networks without training substitute models","venue":null,"work_id":"a1b84f69-3ca8-4416-a750-92bc372250b5","year":2017},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:15.755951Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:333d605181858abc03c0eec630abea46f07f4a6aad508fb2fb14e744f8258f77","observation_id":"05abc027-dc7c-4aa8-9a00-fc3725e0da2e","resolution":{"observed_at":"2026-08-07T05:06:24.415298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07698","last_updated":"2024-10-10T08:10:53Z","snapshot_observed_at":"2026-08-09T07:30:02.056594Z","submitted_at":"2024-10-10T08:10:53Z","title":"Enhancing Zeroth-order Fine-tuning for Language Models with Low-rank Structures","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07698","snapshot_observed_at":"2026-08-07T05:06:15.802479Z","title":"Enhancing zeroth-order fine-tuning for language models with low-rank structures","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:15.802479Z"},"links":{"cited_paper":"/paper/2410.07698","citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:aec0cc5dd6bc90c3aa9deb3ea99d2ea3e321f7d3c3cb76759d8655ba228d8535","observation_id":"35bdf3e2-071b-4dd9-a96c-d43b08afd38a","resolution":{"observed_at":"2026-08-07T05:06:15.802479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07222","last_updated":"2025-02-11T03:32:10Z","snapshot_observed_at":"2026-08-08T13:23:06.239630Z","submitted_at":"2025-02-11T03:32:10Z","title":"A Memory Efficient Randomized Subspace Optimization Method for Training Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07222","snapshot_observed_at":"2026-08-07T05:06:15.845262Z","title":"A memory efficient ran- domized subspace optimization method for training large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:15.845262Z"},"links":{"cited_paper":"/paper/2502.07222","citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:1fdabe0b84e550ac0691405e7fb8b5718a1433e8084e56a4bb72476e96e92c99","observation_id":"975a7038-cd34-481d-aa55-a59dd83bf1a5","resolution":{"observed_at":"2026-08-07T05:06:15.845262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:24.405964Z","title":"GPT3.int8(): 8-bit matrix multiplication for transformers at scale","venue":null,"work_id":"536bdc1a-86e5-43d6-a41f-44c45419713a","year":2022},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:15.896519Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:fe43ea678aee9e0ffe6bffede2e6d58074f2657d9e70abce4283f70def1fe0ff","observation_id":"20615687-81d2-4e0a-ad71-29d0ef3c4417","resolution":{"observed_at":"2026-08-07T05:06:24.408392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:15.936065Z","title":"8-bit optimizers via block-wise quantization","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:15.936065Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:c2b8f3cb9bc2535597bc70f13d28b65b31ff391ca92fdeb8117b9124a4cb67d2","observation_id":"5294bc00-f242-4a35-b7f4-bdc387a05153","resolution":{"observed_at":"2026-08-07T05:06:15.936065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:16.038500Z","title":"Qlora: Efficient finetuning of quantized llms, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:16.038500Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:842de878deb36134a582bb772ddc7169ccd6f3be7fb5e6c6b45b4955db070ea9","observation_id":"a4b9fe58-c35a-4c89-94a3-c86a43a0e664","resolution":{"observed_at":"2026-08-07T05:06:16.038500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:24.391072Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":"bd7c4566-4570-452b-b10e-daa586aab64c","year":2019},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:16.090719Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:207e4d01a32e26829d567c29a94b68184adb5ded3941e62cb56b40a3b5ef2a22","observation_id":"20b3b0fe-48d0-4c9f-8777-5637d4638ad9","resolution":{"observed_at":"2026-08-07T05:06:24.393584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:24.309814Z","title":"Adaptive subgradient methods for online learning and stochastic optimization","venue":null,"work_id":"fc0d8bb1-713e-49d2-99f2-48a355774890","year":2011},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:16.172173Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:c14c43f2d8e74f35b76718d5f4ffc7fa19fe770d9dd3d84c481f9d21c02672a6","observation_id":"e8a5f2b3-b981-4f41-97ca-f590a2cefbf1","resolution":{"observed_at":"2026-08-07T05:06:24.386626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:16.222588Z","title":"Textbooks are all you need, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:16.222588Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:3282efac99968a059b6f7fac88b8e1882a25d6555521d093661b47225ac40365","observation_id":"c143d954-200f-4a0a-86bb-7edaf31096c2","resolution":{"observed_at":"2026-08-07T05:06:16.222588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02913","last_updated":"2024-06-05T04:07:35Z","snapshot_observed_at":"2026-07-06T18:25:40.229186Z","submitted_at":"2024-06-05T04:07:35Z","title":"Zeroth-Order Fine-Tuning of LLMs with Extreme Sparsity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02913","snapshot_observed_at":"2026-08-07T05:06:16.307400Z","title":"Zeroth-order fine-tuning of llms with extreme sparsity","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:16.307400Z"},"links":{"cited_paper":"/paper/2406.02913","citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:6781c7210dbfd476bf1d5843fac7e155d83001b36ac103d89609cb8258e52c36","observation_id":"c4284200-f4fe-4928-8567-39e794d90df7","resolution":{"observed_at":"2026-08-07T05:06:16.307400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:24.053390Z","title":null,"venue":null,"work_id":"6150dfad-2acf-4459-85c5-89354c84b157","year":2020},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:16.415959Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:50f3bdc10c6ecf740930a0b3082c4b8a4bd6746c42c3df0991f67dc00bf7d002","observation_id":"17cb967b-d8ee-4486-8dfd-bda3862c0c81","resolution":{"observed_at":"2026-08-07T05:06:24.173648Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:23.831286Z","title":"Zavlanos","venue":null,"work_id":"0557e8fe-85a2-448c-8767-62acd18e927f","year":2018},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:16.489305Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:64dc5d015f51aac479022afcc31714befa189c87a5123e8e4802252683b4fee7","observation_id":"0f0e9a1e-8a0b-40cb-95b9-8fad43bd4aec","resolution":{"observed_at":"2026-08-07T05:06:23.965917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:16.559194Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:16.559194Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:71efc68db97376ad6d2517137ed4e79e8768dbc3831f1ae2ae004b7aca118b7d","observation_id":"a5eaa212-133c-4066-8914-753c4472616d","resolution":{"observed_at":"2026-08-07T05:06:16.559194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:23.616583Z","title":"Zo-adamu optimizer: Adapting perturbation by the momentum and uncertainty in zeroth-order optimization, 2023","venue":null,"work_id":"c4b883d9-3ad4-4216-846b-0be4f6f201a1","year":2023},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:16.606241Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:e216adb61164cc7c51991ca36a245f84f88353a85810c61f23d5ec52ce0c1e40","observation_id":"172528c3-4b53-4af2-8b64-b2939fb537f1","resolution":{"observed_at":"2026-08-07T05:06:23.726056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:16.623899Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:16.623899Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:b4fe1c7b4c3e13b6c0865edfde990f7334e117625a1bd6a4960df1683fd047dc","observation_id":"f7cf890b-bbaa-4858-976e-d0fb7e48d6fd","resolution":{"observed_at":"2026-08-07T05:06:16.623899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:23.409748Z","title":"Albert: A lite bert for self-supervised learning of language representations","venue":null,"work_id":"0f97b3e5-9fdb-4346-90c8-fe077ee97dc6","year":2020},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:16.701332Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:dab3b36f7517ee4e732a73861358841402bfc0e5e83aa9037a39e9194a17aa70","observation_id":"4c7709c2-60ad-4309-ae96-db758ec9a2f2","resolution":{"observed_at":"2026-08-07T05:06:23.482983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:23.277565Z","title":"Prefix-tuning: Optimizing continuous prompts for generation","venue":null,"work_id":"e3c3f85b-df20-4d45-a4a2-a2f396577f9b","year":2021},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:16.810930Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:6064a32ac377f4a7a16a3f22f166a3a9b57a1aef401b94f8026186dfae751833","observation_id":"d6dc67bb-bb87-44bb-8a25-4f9a7ac34a45","resolution":{"observed_at":"2026-08-07T05:06:23.356801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:16.901601Z","title":"Textbooks are all you need ii: phi-1.5 technical report, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:16.901601Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:e7591eb03ba5d7a1ae47062c13e088e2843469046908ca6f48871d8f4afea167","observation_id":"1cdb2e0a-cf70-469e-83ed-7b0c03f2614d","resolution":{"observed_at":"2026-08-07T05:06:16.901601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:23.121548Z","title":"signsgd via zeroth-order oracle","venue":null,"work_id":"4b2d48a8-57d9-46ba-9c1a-8d6acade90af","year":2019},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:16.997682Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:b16d574ae1da51bc59d2a433a412a5cf9a6d3628fa290c27bdf0518ef628f4c8","observation_id":"865d6881-f6fe-435b-bc00-274e563e421f","resolution":{"observed_at":"2026-08-07T05:06:23.204103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T05:06:17.072071Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:17.072071Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:6efc47f8f9655f3354cfd35ad142705dc5ff07f0d5e77c505045a2b3b298a900","observation_id":"563022af-63b8-4a70-a694-054d5dbc81aa","resolution":{"observed_at":"2026-08-07T05:06:17.072071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:17.182911Z","title":"Sparse mezo: Less parameters for better performance in zeroth-order llm fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:17.182911Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:d4f283f3410e413367958dbab2bccbe48a09d7a1ed15d6ad90284f8c892fb0a2","observation_id":"ed613990-0059-45ad-b0e8-d1316faf0db8","resolution":{"observed_at":"2026-08-07T05:06:17.182911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:17.264158Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:17.264158Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:f46aea9d48324f50e2285de17293c0919af53ac143a3f931d05766130e94828d","observation_id":"a4a5eb1e-34da-4c88-a298-2fb9c9067fa0","resolution":{"observed_at":"2026-08-07T05:06:17.264158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:17.367818Z","title":"Lee, Danqi Chen, and Sanjeev Arora","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:17.367818Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:c7a0fb82e1edb3501826f5ce34e0db930f88b59740fd4c83832936aa74e86f2e","observation_id":"042c8757-de5b-42f3-a0e4-337073035447","resolution":{"observed_at":"2026-08-07T05:06:17.367818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:22.939930Z","title":"Simple random search provides a competitive approach to reinforcement learning, 2018","venue":null,"work_id":"c274369f-5590-46c5-95b1-1fde92bc94b3","year":2018},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:17.406022Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:22148a62f147babc18c3eba6bf193552e2134c8c04d2b95f132797b4bbd6e915","observation_id":"1c6e0877-933f-4896-b0eb-f0727a7f9b0b","resolution":{"observed_at":"2026-08-07T05:06:23.018149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:17.468576Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:17.468576Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:ae8a36b2fdb6a9eb3352ea79f62a9e110a86ea96bf677d9ddea6e4c76320e4ac","observation_id":"9b9d7cf5-e40d-4f64-a9a6-f7fd34e28847","resolution":{"observed_at":"2026-08-07T05:06:17.468576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:22.795308Z","title":"Lisa: Layerwise importance sampling for memory-efficient large language model fine-tuning, 2024","venue":null,"work_id":"04f8d39a-c7cf-4093-ac87-244a6e14bac8","year":2024},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:17.545390Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:3958f1dc64b4c924fe2fd3f280cd57b467b2bf21b2e76c7bf92b9a70fc5d979b","observation_id":"ea2d796c-6421-4d27-b060-3ab2c5446ed0","resolution":{"observed_at":"2026-08-07T05:06:22.865569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:17.644348Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:17.644348Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:55e53d7714f0bc9bd83fc4d36b6b80b7231801072186f440d1e9de7318c8f574","observation_id":"62ccb30b-39f4-423c-a1be-fbd6eb82680d","resolution":{"observed_at":"2026-08-07T05:06:17.644348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:22.621699Z","title":null,"venue":null,"work_id":"163ee04b-a128-4201-89d5-db9910812bed","year":1992},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:17.748667Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:5518d7902724c8cdb9036dbd4a2589cbeeca04e2015972a553fc9b40aacc18f6","observation_id":"06ce70c0-b402-40f7-8d61-b24aaf6386c9","resolution":{"observed_at":"2026-08-07T05:06:22.694110Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:22.453603Z","title":"BBTv2: Towards a gradient-free future with large language models","venue":null,"work_id":"3fc53576-bfa9-4862-a61a-7640f15c8c27","year":2022},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:17.850288Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:f954b1ee8ed9929c82aad29cfb1761d2e6abade1db1f9959a180e0dbabe8c9c7","observation_id":"c632f105-acfe-4d98-ad6a-743a0201f256","resolution":{"observed_at":"2026-08-07T05:06:22.536947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:22.212300Z","title":"Black-box tuning for language-model-as-a-service","venue":null,"work_id":"585ebcca-3c15-4d72-87d4-cffe074ec761","year":2022},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:17.928240Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:abd0d9dc8b4c2fe60ed8a42bb91dc7832c7453a3e4c5dccb67558ddc818f047d","observation_id":"23bfa0b2-9ae4-4d8b-b383-98630456cd7c","resolution":{"observed_at":"2026-08-07T05:06:22.324272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19057","last_updated":"2025-01-31T11:34:03Z","snapshot_observed_at":"2026-08-09T21:25:30.819771Z","submitted_at":"2025-01-31T11:34:03Z","title":"TeZO: Empowering the Low-Rankness on the Temporal Dimension in the Zeroth-Order Optimization for Fine-tuning LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19057","snapshot_observed_at":"2026-08-07T05:06:18.054020Z","title":"Tezo: Empowering the low-rankness on the temporal dimension in the zeroth-order optimization for fine-tuning llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:18.054020Z"},"links":{"cited_paper":"/paper/2501.19057","citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:24f306ac3a7a12af6226d002acfe68531cb38e1ad87558b23132e827e92941e4","observation_id":"6e76a80a-b0e6-44fe-ac7a-e0d00ebef3bd","resolution":{"observed_at":"2026-08-07T05:06:18.054020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:18.152996Z","title":"Harmony in divergence: Towards fast, accurate, and memory-efficient zeroth-order llm fine-tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:18.152996Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:127a6bb18d38e80a215dd51e647917f4f9d84b9632ef8250d34e5dbd66c0dc0a","observation_id":"0c51361b-1e85-44d6-9190-626648992dc0","resolution":{"observed_at":"2026-08-07T05:06:18.152996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:22.051964Z","title":"Effectively learning from data and generating data in differentially private machine learning","venue":null,"work_id":"525d849d-98a1-4476-9c30-1019f08557c7","year":2024},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:18.281025Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:10e224cea460c38c7c3316d89a5a348a1975c807ae2934c3965bff4b0bce763e","observation_id":"04ce3f0a-5e64-43e2-98b6-97ff7b715667","resolution":{"observed_at":"2026-08-07T05:06:22.114987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:21.842226Z","title":"Distributed zero-order algorithms for nonconvex multiagent optimization","venue":null,"work_id":"6b248b8a-da74-408a-85d4-ea620e34bc22","year":2021},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:18.335025Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:06a60f0833a1f7cfff2daeeadf142d5d0ac5eec22c2e76f10a59ea33899a2752","observation_id":"21492fc8-527b-42c2-8d83-f821add45a0c","resolution":{"observed_at":"2026-08-07T05:06:21.955664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T05:06:18.436730Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:18.436730Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:325ed2354f747ec2cbdbc7c27f686c31bddc18c1998e30ca622309142d94e967","observation_id":"74ae041b-b99f-4226-a51d-ffd727544402","resolution":{"observed_at":"2026-08-07T05:06:18.436730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:21.655095Z","title":"ReLIZO: Sample reusable linear interpolation-based zeroth-order optimization","venue":null,"work_id":"000579af-6ae1-435b-bc47-8f574be34ba4","year":2024},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:18.586916Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:6f3d498f752dec9c0890b5416df30e1c9de7fc78248b2c345c0064a74ff7c170","observation_id":"d1f4b06b-ef8f-47ef-8c3f-740a5c66cc9e","resolution":{"observed_at":"2026-08-07T05:06:21.761290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:21.463748Z","title":"The advancement in stochastic zeroth-order optimization: Mechanism of accelerated convergence of gaussian direction on objectives with skewed hessian eigenvalues","venue":null,"work_id":"5db9640e-79a2-4127-869b-2d0ce2dfb74e","year":null},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:18.672796Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:46604e211f20fc7c675e3fdeca3f28aa1ce83d7013a34b78c5cc95497f9c4854","observation_id":"f1fdc6fb-1f79-4e92-b66d-432319aa900b","resolution":{"observed_at":"2026-08-07T05:06:21.532020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:18.710375Z","title":"Roofline: an insightful visual performance model for multicore architectures","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:18.710375Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:56a3c353902c68e8aa786a4e8ba263b36f2f1b6ff6011062377835c8c52125c7","observation_id":"3c8c5f01-987a-4a5e-bc27-6c45ef8225e5","resolution":{"observed_at":"2026-08-07T05:06:18.710375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:21.253459Z","title":"Hessian-aware zeroth-order optimization for black-box adversarial attack, 2019","venue":null,"work_id":"0764745e-c015-413f-80d6-46d17de132d9","year":2019},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:18.779192Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:3b2f28fe646ff286ecb1b8641fe175e8a1f85796275fe7c8803d72e84f903e2c","observation_id":"aaf8ad52-c4c6-4d25-8bfd-edcee998b732","resolution":{"observed_at":"2026-08-07T05:06:21.344016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:21.075541Z","title":"Large batch optimization for deep learning: Training bert in 76 minutes","venue":null,"work_id":"60626342-fb1c-4fe4-b410-1269b4a7159f","year":2020},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:18.860276Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:8dd0f35b445873a35e7311c9ceb78efbe8ec2021d0f2985e188f6d932ae876d1","observation_id":"94bd0414-eb3a-42bc-858e-a95dfaf0323e","resolution":{"observed_at":"2026-08-07T05:06:21.137208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:20.861922Z","title":null,"venue":null,"work_id":"62d67960-d418-4226-aeea-40c40584e0ab","year":2012},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:18.940160Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:de0c7994a9589fab2f6e9053d5f6046860199e284659a89efd3886ba7215bc56","observation_id":"905aced8-6cfb-4472-a306-7add2198017e","resolution":{"observed_at":"2026-08-07T05:06:20.961251Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:19.038794Z","title":"Opt: Open pre-trained transformer language models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:19.038794Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:49118589f49589def29426345ee77e26cb90589802d92c5933c5b92abb79a556","observation_id":"fefcf173-d5eb-483b-ab6d-a5b565581441","resolution":{"observed_at":"2026-08-07T05:06:19.038794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:20.698701Z","title":"Zavlanos","venue":null,"work_id":"ac13cf49-5710-45e2-af85-77012660a584","year":2022},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:19.110880Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:c2c849b71b89b6ab690a2436a2b7cb8bbb4492c2218dffadb7f0656ffab9e29a","observation_id":"df4b3d29-ff6a-477a-b461-3e7b429bd766","resolution":{"observed_at":"2026-08-07T05:06:20.771156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:20.478442Z","title":"Lee, Wotao Yin, Mingyi Hong, Zhangyang Wang, Sijia Liu, and Tianlong Chen","venue":null,"work_id":"6e35b32f-9991-454c-a3a1-9883a646e0ce","year":2024},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:19.249919Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:7a890903c5f002a841133c3b1bec7c27b255388c837e6c5a4db3e7936e1dc452","observation_id":"bb4ce295-f819-4ebf-ae80-2ac85949181f","resolution":{"observed_at":"2026-08-07T05:06:20.602533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10696","last_updated":"2024-11-16T04:27:22Z","snapshot_observed_at":"2026-07-06T19:51:19.204783Z","submitted_at":"2024-11-16T04:27:22Z","title":"HELENE: Hessian Layer-wise Clipping and Gradient Annealing for Accelerating Fine-tuning LLM with Zeroth-order Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10696","snapshot_observed_at":"2026-08-07T05:06:19.410634Z","title":"Helene: Hessian layer-wise clipping and gradient annealing for accelerating fine-tuning llm with zeroth-order optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:19.410634Z"},"links":{"cited_paper":"/paper/2411.10696","citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:cc4d52a5cbf310c7049d72da18f934f3ee1f0abf78e4be7e6404dbd6c9df1e3b","observation_id":"6595f162-355b-4091-a23e-eab03b37bbae","resolution":{"observed_at":"2026-08-07T05:06:19.410634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:20.193451Z","title":"Galore: Memory-efficient llm training by gradient low-rank projection","venue":null,"work_id":"f8bc23b8-b4c1-4a6c-a765-239a5eb8f805","year":2024},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:19.524923Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:23baf9892bd5ae65961d8d530273015d7390c788556610ea41c401378cf25bd2","observation_id":"b6128f5b-f2b7-49fa-9e46-2a37b1434676","resolution":{"observed_at":"2026-08-07T05:06:20.339945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:06:19.954125Z","title":null,"venue":null,"work_id":"b48bda1d-245d-4057-b1d0-49ca410fd8d3","year":2025},"citing_paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:06:19.639140Z"},"links":{"citing_paper":"/paper/2506.09034"},"observation_digest":"sha256:a9ec12a2d57c98610dfb2dd149fbdff9d5b7bb4555708bd720b098783809b3db","observation_id":"1486d2ea-dd9f-468d-9000-f53a10e0db4f","resolution":{"observed_at":"2026-08-07T05:06:20.055849Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.09034","last_updated":"2025-06-30T03:33:12Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T04:54:31.477265Z","submitted_at":"2025-06-10T17:56:53Z","title":"FZOO: Fast Zeroth-Order Optimizer for Fine-Tuning Large Language Models towards Adam-Scale Speed"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 2 inbound Pith citation observations for arXiv:2506.09034."}