{"as_of":"2026-08-10T14:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1ca555e1e3d8593502790c52fdd0a4658e3719734a5d79ff8633a9322d944dfc","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T16:14:03.217184Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T21:56:28.103866Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T08:19:44.419278Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01235","snapshot_observed_at":"2026-08-07T21:56:28.103866Z","title":"One-step full gradient suffices for low-rank fine-tuning, provably and efficiently","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.103866Z"},"links":{"cited_paper":"/paper/2502.01235","citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:cdf51f3f51f21cb922137591a4b865ab4964897ba54745550b75593947570b6d","observation_id":"697a3dbe-9bbf-4765-b1d1-41004303ff33","resolution":{"observed_at":"2026-08-07T21:56:28.103866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01235","snapshot_observed_at":"2026-08-07T13:04:50.710627Z","title":"One-step full gradient suffices for low-rank fine-tuning, provably and efficiently","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23194","last_updated":"2025-08-17T05:48:16Z","snapshot_observed_at":"2026-08-07T12:48:51.160815Z","submitted_at":"2025-05-29T07:33:03Z","title":"Beyond Zero Initialization: Investigating the Impact of Non-Zero Initialization on LoRA Fine-Tuning Dynamics","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:04:50.710627Z"},"links":{"cited_paper":"/paper/2502.01235","citing_paper":"/paper/2505.23194"},"observation_digest":"sha256:92f9597f8c02e9d089a734062ed8397ff4452d9fd0d3002764df39d97acc8c79","observation_id":"4a5746d7-93e9-4521-a468-ba60d607330b","resolution":{"observed_at":"2026-08-07T13:04:50.710627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"cited_work":{"arxiv_id":"2502.01235","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01235","snapshot_observed_at":"2026-07-04T08:19:44.419278Z","title":"Zhang, F","venue":null,"work_id":"d02aabd6-6d11-4b1b-9d43-556003ce16d5","year":2025},"citing_paper":{"arxiv_id":"2606.05899","last_updated":"2026-06-04T09:05:59Z","snapshot_observed_at":"2026-07-06T23:45:51.910263Z","submitted_at":"2026-06-04T09:05:59Z","title":"High-Dimensional Theory of LoRA Fine-Tuning in a Solvable Attention Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T02:14:38.644041Z"},"links":{"cited_paper":"/paper/2502.01235","citing_paper":"/paper/2606.05899"},"observation_digest":"sha256:b8c67b2fbdc86303feeec634e48057f70d4b1cc9719515d10e568eee3bb9d7d0","observation_id":"a3c2d280-9bbc-41f0-88fb-86d9c5507173","resolution":{"observed_at":"2026-07-02T12:16:57.382824Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"cited_work":{"arxiv_id":"2502.01235","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01235","snapshot_observed_at":"2026-07-04T08:19:44.419278Z","title":"Zhang, F","venue":null,"work_id":"d02aabd6-6d11-4b1b-9d43-556003ce16d5","year":2025},"citing_paper":{"arxiv_id":"2606.12883","last_updated":"2026-06-11T04:19:32Z","snapshot_observed_at":"2026-08-02T22:02:12.932569Z","submitted_at":"2026-06-11T04:19:32Z","title":"The Hidden Power of Scaling Factor in LoRA Optimization","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-06-27T07:14:08.479610Z"},"links":{"cited_paper":"/paper/2502.01235","citing_paper":"/paper/2606.12883"},"observation_digest":"sha256:5a046bf11da56bcdb8067e88436ec98a8245434bf19835aba7ea3356fd80ecfc","observation_id":"28f8896a-54b2-4298-94b6-6a50faacb722","resolution":{"observed_at":"2026-07-03T14:08:21.934456Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"cited_work":{"arxiv_id":"2502.01235","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01235","snapshot_observed_at":"2026-07-04T08:19:44.419278Z","title":"Zhang, F","venue":null,"work_id":"d02aabd6-6d11-4b1b-9d43-556003ce16d5","year":2025},"citing_paper":{"arxiv_id":"2606.22019","last_updated":"2026-06-20T12:48:31Z","snapshot_observed_at":"2026-08-06T19:21:18.734073Z","submitted_at":"2026-06-20T12:48:31Z","title":"Channel Location Constrains the Auditability of Subliminal Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T11:52:03.948568Z"},"links":{"cited_paper":"/paper/2502.01235","citing_paper":"/paper/2606.22019"},"observation_digest":"sha256:ba50d850c767801d549baf00cc7571048c2b4ce7e75fb94cca23679989c7ad86","observation_id":"fff784f6-0818-4b94-9f82-4a35e93baf58","resolution":{"observed_at":"2026-07-04T08:19:44.420644Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01235","snapshot_observed_at":"2026-08-01T00:26:41.122870Z","title":"arXiv preprint arXiv:2502.01235 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26247","last_updated":"2026-07-28T20:32:04Z","snapshot_observed_at":"2026-08-03T17:13:17.383834Z","submitted_at":"2026-07-28T20:32:04Z","title":"Between Gradient and Natural Gradient: A Continuum of LoRA Initializations","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T00:26:41.122870Z"},"links":{"cited_paper":"/paper/2502.01235","citing_paper":"/paper/2607.26247"},"observation_digest":"sha256:2084eeb15c6d16aff07afe2600f96700a45abc0c36d765e4e46ccac1200b1666","observation_id":"8b72c719-4d81-4fd3-983f-4896b623a813","resolution":{"observed_at":"2026-08-01T00:26:41.122870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.01235/citation-record","integrity":"/paper/2502.01235/integrity","json":"/paper/2502.01235/citation-record.json","paper":"/paper/2502.01235"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:02.888781Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.888781Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:b683f3a389839dba2472ed31a5001a7c37d56084ac2dadb2d1df96238cc77cb4","observation_id":"462bf1e5-8550-47be-9f93-7e2ff097b7f0","resolution":{"observed_at":"2026-08-09T16:14:02.888781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:04.111625Z","title":"B., and Misiakiewicz, T","venue":null,"work_id":"b3f1bc6f-27b7-4e87-adde-fd9ca1e26b4c","year":2022},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.893846Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:87b1973f6ebdbfa7b9ce89ae635bc8d746594d15b4a3b816cab0b70300ae16eb","observation_id":"644056ed-832b-441d-ab4b-bdeec8ef356a","resolution":{"observed_at":"2026-08-09T16:14:04.114840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:04.102253Z","title":"B., Gheissari, R., and Jagannath, A","venue":null,"work_id":"c34a9f59-c8a2-464c-87d6-3dc1e7e103f1","year":2021},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.898134Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:96e5797069afcdae944eb08bedb59ae10ba7161d7889001cb897dc0a5fe81a53","observation_id":"e6ba61ca-11b8-4775-9bff-8f07af338dcc","resolution":{"observed_at":"2026-08-09T16:14:04.105638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:04.092323Z","title":"A., Suzuki, T., Wang, Z., Wu, D., and Yang, G","venue":null,"work_id":"14178673-a4bd-450d-a8c6-70bb3fcf715c","year":2022},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.902004Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:7725ba76969f719450cdfdf750f51c41f4c594310d49126171c61c6200083d30","observation_id":"626bc842-4736-4de2-bc3c-d861dc6a84d4","resolution":{"observed_at":"2026-08-09T16:14:04.096306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19793","last_updated":"2023-11-02T17:33:13Z","snapshot_observed_at":"2026-08-10T03:43:25.479987Z","submitted_at":"2023-10-30T17:55:28Z","title":"On Learning Gaussian Multi-index Models with Gradient Flow","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19793","snapshot_observed_at":"2026-08-09T16:14:02.905499Z","title":"On learning gaussian multi-index models with gradient flow","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.905499Z"},"links":{"cited_paper":"/paper/2310.19793","citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:8746b03bb6c26f4b3f188b40db1236caa3f42ed9408277fb8d4dc436a29336ce","observation_id":"7c5dcf07-7fc7-437a-93a3-ce4d5ed23f94","resolution":{"observed_at":"2026-08-09T16:14:02.905499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:04.081688Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":"5151aa52-a69f-449c-8dc0-e695cf9d8c50","year":1901},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.909622Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:f81a47e98826c3b97e3c9b067ac6ab26ed6e7d861116c4c934c47e741ce9dc10","observation_id":"7f1f1f3c-05de-4915-b892-5865ddb6579d","resolution":{"observed_at":"2026-08-09T16:14:04.085936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:04.071231Z","title":"and Globerson, A","venue":null,"work_id":"6de65765-12dd-47ff-9458-18cc38303947","year":2017},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.913174Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:9858476f73cf056fa30d1e8aeee98c9ca945520f6accfcdcdc3c136f52a18b87","observation_id":"d4b68798-acee-4590-a631-7ca4376979fc","resolution":{"observed_at":"2026-08-09T16:14:04.075394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-09T16:14:02.916927Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.916927Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:80b4dad05a1f6385f2bc2e0ffc844ae740d04f55a12852a967426e02b4dbe405","observation_id":"85cc30b3-8bac-4898-8ece-af56d093965d","resolution":{"observed_at":"2026-08-09T16:14:02.916927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:04.060875Z","title":"Spectral Methods for Data Science: A Statistical Perspective","venue":null,"work_id":"33af504f-4962-4667-b092-a3794ee0797c","year":2021},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.920721Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:7d4f872c641deff36d3ad8300f26723423f23874474f0ef4cda5d5e8cad43670","observation_id":"48546637-5ae7-47bd-806c-e3c3b1d91fc1","resolution":{"observed_at":"2026-08-09T16:14:04.065085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-09T16:14:02.923917Z","title":"Training Verifiers to Solve Math Word Problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.923917Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:0d33e141e43324417e82729c28e6521c6dc8ba4f06cdc9f754f825830fdc504e","observation_id":"649b22e3-415b-452e-a306-84835fc35e7b","resolution":{"observed_at":"2026-08-09T16:14:02.923917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:04.051686Z","title":"Asymptotics of feature learning in two-layer networks after one gradient-step","venue":null,"work_id":"30bf788b-8c32-4e37-9343-b604a291bafd","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.927559Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:94594714857db6d5548251c3186dc9961074bfb29979fcea3cbf4e7cd7514a38","observation_id":"6e462e18-0f7e-4044-a8b6-8b0dab09db04","resolution":{"observed_at":"2026-08-09T16:14:04.055044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:04.042468Z","title":"Neural Networks can Learn Representations with Gradient Descent","venue":null,"work_id":"4eb7cfba-a81a-44aa-80fa-7afe651eb2de","year":2022},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.931009Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:921821b44febb7d92b32c0cf25323efbe307114c0b563343a4682dc7428175f8","observation_id":"e116cae6-7729-44d1-8a60-493faa78a7d5","resolution":{"observed_at":"2026-08-09T16:14:04.045696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:04.033245Z","title":"A Random Matrix Theory Perspective on the Spectrum of Learned Features and Asymptotic Generalization Capabilities","venue":null,"work_id":"10fba045-361d-4fee-951a-bb96111af32c","year":2025},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.934375Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:dc1fd7deba3d1cb0a6f965151e40e1af633732af4d45a8afac0e13561f775a49","observation_id":"3314f5aa-ff33-4535-a474-0267a9f8058e","resolution":{"observed_at":"2026-08-09T16:14:04.036566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15385","last_updated":"2024-11-23T00:00:28Z","snapshot_observed_at":"2026-07-06T19:55:51.415524Z","submitted_at":"2024-11-23T00:00:28Z","title":"Gradient dynamics for low-rank fine-tuning beyond kernels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15385","snapshot_observed_at":"2026-08-09T16:14:02.937714Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.937714Z"},"links":{"cited_paper":"/paper/2411.15385","citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:0d1447188ec5126f50d029c13f645b94c39e63d64abaacc04eb554cb0d97ef5c","observation_id":"bf0b7bf0-f1c0-48d5-acaf-4b6dc09c3b45","resolution":{"observed_at":"2026-08-09T16:14:02.937714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10675","last_updated":"2025-07-25T22:41:37Z","snapshot_observed_at":"2026-08-01T23:38:59.936253Z","submitted_at":"2022-09-21T22:01:23Z","title":"A Validation Approach to Over-parameterized Matrix and Image Recovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10675","snapshot_observed_at":"2026-08-09T16:14:02.941442Z","title":"A Validation Approach to Over-parameterized Matrix and Image Recovery","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.941442Z"},"links":{"cited_paper":"/paper/2209.10675","citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:f14fa542a41e8518a6c25bf4272fe73a754f54b74665641f70090d769e61f1af","observation_id":"5e1709bc-9387-456d-b21a-7b1c45bb00f9","resolution":{"observed_at":"2026-08-09T16:14:02.941442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06305","last_updated":"2020-02-15T02:40:10Z","snapshot_observed_at":"2026-08-07T15:45:43.952318Z","submitted_at":"2020-02-15T02:40:10Z","title":"Fine-Tuning Pretrained Language Models: Weight Initializations, Data Orders, and Early Stopping","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.06305","snapshot_observed_at":"2026-08-09T16:14:02.944915Z","title":"Fine-Tuning Pretrained Language Models: Weight Initializations, Data Orders, and Early Stopping","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.944915Z"},"links":{"cited_paper":"/paper/2002.06305","citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:43535cac9c6bba60ff70966a78850455322d9f58f22381d82e19de9a0fd9ba06","observation_id":"b99e2f76-42ae-4e11-924f-b3f4a8c76130","resolution":{"observed_at":"2026-08-09T16:14:02.944915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16826","last_updated":"2025-05-29T11:38:57Z","snapshot_observed_at":"2026-08-05T23:33:00.804488Z","submitted_at":"2024-10-22T08:58:44Z","title":"Guarantees of a Preconditioned Subgradient Algorithm for Overparameterized Asymmetric Low-rank Matrix Recovery","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16826","snapshot_observed_at":"2026-08-09T16:14:02.948587Z","title":"Guarantees of a Preconditioned Subgradient Algorithm for Overparameterized Asymmetric Low-rank Matrix Recovery","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.948587Z"},"links":{"cited_paper":"/paper/2410.16826","citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:b1b8e31d890e551df692e0b16770d1b75ee40ffc7ea21b9879ce5866a5b8c07e","observation_id":"8382eb65-8cfe-40cf-94e2-891b6f27ced0","resolution":{"observed_at":"2026-08-09T16:14:02.948587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:04.024068Z","title":null,"venue":null,"work_id":"fede1661-ce9f-4166-9f26-b949f22d9926","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.951951Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:5f47d2d0cfd7dc89842b9a4c1a21e2444f3d2f8d3ed85b21e637d6d0d12deaac","observation_id":"23b7d1fe-500e-4e8d-88e6-7e3fcfb18958","resolution":{"observed_at":"2026-08-09T16:14:04.027191Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:04.015675Z","title":"LoRA+: Efficient Low Rank Adaptation of Large Models","venue":null,"work_id":"5e7a368d-89a7-4ef9-9026-78b9e223173e","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.955262Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:7c26b8284e955241ff6f8d2dc2b4e1814931e43edb84e43348404f56b525e53d","observation_id":"74c1a6d8-fd61-410d-bcfe-7ba3be3cef3a","resolution":{"observed_at":"2026-08-09T16:14:04.018721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:04.006686Z","title":"Delving Deep into Rectifiers: Surpassing Human-Level Performance on ImageNet Classification","venue":null,"work_id":"bebe24ab-62dd-4cf4-adda-ab0db791e02f","year":2015},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.958771Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:ad169e21947b494c908e723fe4b4467e0ae135778261cac076fb89323ec4425a","observation_id":"c48f2021-df4d-44a0-b273-6e436e1f82f2","resolution":{"observed_at":"2026-08-09T16:14:04.009812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.995895Z","title":"Measuring Massive Multitask Language Understanding","venue":null,"work_id":"ba2cd29e-2ae2-403a-82ca-44c02a548ec3","year":2021},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.961932Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:a25d65ce1f5ce1428d08a177246071a8f60da0b48d2da1e3c17f1d8ea7aca776","observation_id":"413f5f18-1fbf-4421-9384-0a51ac54e442","resolution":{"observed_at":"2026-08-09T16:14:04.000570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.986142Z","title":null,"venue":null,"work_id":"886dc9b8-40f7-4dec-85be-fba725e2fd35","year":2012},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.965088Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:3871ce56f7a9650f549af6de4b71e36855a8dcd181379c1671708ee288d8807a","observation_id":"37da9ef0-368b-45d1-bc2a-5327a1357c34","resolution":{"observed_at":"2026-08-09T16:14:03.989655Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.975423Z","title":"Parameter-Efficient Transfer Learning for NLP","venue":null,"work_id":"3f1564d5-f0d5-46f2-a381-8d3f28d967e3","year":2019},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.968140Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:591a79af5808b7ee061017db50ef19f0c971e9cf0b84e68b9fb6ebbda6469c5c","observation_id":"86570e6e-43f2-482e-b0b5-2d0bf88405bb","resolution":{"observed_at":"2026-08-09T16:14:03.979644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.963980Z","title":"J., Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., Chen, W., et al","venue":null,"work_id":"a532fcda-4747-4adc-bbf8-7eed3e1a760b","year":2022},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.971219Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:a4b961bb4d4a1b9d8e911157f9736c274188b10e43a2b16c7330c4b481775d8c","observation_id":"ec156b75-6e4e-4e6c-a419-f6c25f90b649","resolution":{"observed_at":"2026-08-09T16:14:03.967917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.811776Z","title":"Neural Tangent Kernel: Convergence and Generalization in Neural Networks","venue":null,"work_id":"296b0936-f1aa-47bf-8a80-454de918e336","year":2018},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.974218Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:afdbb54ff09e67ba5e82dc6b94fadfee7b1e210ac80ee6bf4cb1404b69422fad","observation_id":"f9d3f4ab-d812-4bee-90cb-53184eb670d1","resolution":{"observed_at":"2026-08-09T16:14:03.815353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.800892Z","title":"D., and Ryu, E","venue":null,"work_id":"cdc2131b-59aa-4e3f-a1f7-9ac5c585649a","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.977443Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:b937d61422dbf91924c0028bce30f1cf65aaeacffb5312b675f51b489575dcba","observation_id":"74993bcd-6c05-4561-911d-fcd4ac771933","resolution":{"observed_at":"2026-08-09T16:14:03.804362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.790680Z","title":"Preconditioning Matters: Fast Global Convergence of Non-convex Matrix Factorization via Scaled Gradient Descent","venue":null,"work_id":"09fd996b-ff20-4849-bd04-bf684180274d","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.980351Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:4359dff77093142921452779194c8d6dd83367ef2c2ed484a07fbef516756c3e","observation_id":"efd34516-c486-459f-aec5-ec2f26e5b657","resolution":{"observed_at":"2026-08-09T16:14:03.794463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.780774Z","title":null,"venue":null,"work_id":"847674e8-2702-47bb-923c-21833e643de9","year":2025},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.983770Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:8eabfc5de7baee14e87de4dd86f8aefc1167a818cd7ba0fc301b318032b007b4","observation_id":"507b22de-18b1-41f6-95b7-cf0d0d60e9ef","resolution":{"observed_at":"2026-08-09T16:14:03.784285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.770472Z","title":"J., Blankevoort, T., and Asano, Y","venue":null,"work_id":"e57ccda2-ab78-403b-9859-1e2a6781910b","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.986735Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:37babb5005bb7fb3d2789a8e1f83416acdc788bb2d66e378a88e50078ebe5c7e","observation_id":"d979948f-07f8-44a3-aaa3-d167844b8f49","resolution":{"observed_at":"2026-08-09T16:14:03.773945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:02.990024Z","title":"The mnist database of handwritten digits","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.990024Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:395938aa4aa5965e844effb7a9305a0c2b8d015b56ada2c6391bc00f3961f6fb","observation_id":"81a27c7d-3539-498f-aa46-46ddf1a50af5","resolution":{"observed_at":"2026-08-09T16:14:02.990024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.754899Z","title":"D., Oko, K., Suzuki, T., and Wu, D","venue":null,"work_id":"707e5147-bc1f-4bb1-9697-e566f0cd659b","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.993044Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:8887891657e3dc6692997c310905bc1adadc06f1e0586cf69b60ebae7fb461db","observation_id":"431a81eb-4f7f-4acf-bf85-08e22846f3be","resolution":{"observed_at":"2026-08-09T16:14:03.758201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.744904Z","title":"On the Crucial Role of Initialization for Matrix Factorization","venue":null,"work_id":"823f2d3c-072f-475a-8812-6e4c2b60ac5f","year":2025},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.996315Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:c12da6d01974fbdbcf7a360f945e0ab084e000aa5904510d1751564bab48ebc0","observation_id":"39584081-cdc2-4d49-ace5-10cda9aba82a","resolution":{"observed_at":"2026-08-09T16:14:03.748389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.734597Z","title":"Algorithmic Regularization in Over-parameterized Matrix Sensing and Neural Networks with Quadratic Activations","venue":null,"work_id":"195eca1a-6526-414d-99bf-0e8ea9092eaf","year":2018},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:02.999225Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:e38d346439c58dfb19267f2c75168fc1df974e6c7d7a816a379b3a80fbbc8231","observation_id":"56ebdc6c-ead3-4e6d-a82a-f0a4cf4edfed","resolution":{"observed_at":"2026-08-09T16:14:03.738387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.724152Z","title":"On the Optimization Landscape of Low Rank Adaptation Methods for Large Language Models","venue":null,"work_id":"1808d5a5-3dbd-41b1-9ee0-4cfc3239de4a","year":2025},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.002320Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:7ef56ab01cd68811d9e30ab50799402e1bd3882f249820eadf858144c0325b38","observation_id":"8907fffc-5fe7-4ce4-b695-266863c44841","resolution":{"observed_at":"2026-08-09T16:14:03.728017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-09T16:14:03.005405Z","title":"and Hutter, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.005405Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:22fa01a11a8943b908ebceb38d395542008334938439efd843bda06038801b82","observation_id":"a02a1bd5-6bfe-41d8-91d0-007ca865b0b3","resolution":{"observed_at":"2026-08-09T16:14:03.005405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.714073Z","title":"Beyond Procrustes: Balancing-Free Gradient Descent for Asymmetric Low-Rank Matrix Sensing","venue":null,"work_id":"b7bd466a-9145-4b99-9142-cf6a2afb1b06","year":2021},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.009041Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:85ec57cd6ca57d8efab70436951baf6d6356992915f956367d5537244e24e85d","observation_id":"c8534b05-0c1c-41ae-9a79-02b67310ef2a","resolution":{"observed_at":"2026-08-09T16:14:03.717706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.704256Z","title":"A Kernel-Based View of Language Model Fine-Tuning","venue":null,"work_id":"26cd6ac8-a0dc-4306-8dc2-e4bc53a1996b","year":2023},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.012039Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:09f82e15b66004b5f669e6660a86bee5cad3a09113024e57c759a9255e8ca075","observation_id":"e7accefa-02ba-4a4b-ae4e-34a55b924577","resolution":{"observed_at":"2026-08-09T16:14:03.707829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.693744Z","title":"PiSSA: Principal Singular Values and Singular Vectors Adaptation of Large Language Models","venue":null,"work_id":"323df65b-77a5-4869-a2af-3e57bc39ecff","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.015077Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:fa2bbf4b3ae9b3bab33e4b2401ae7f500dd8a22b86b407fbf24a2348b2d5f288","observation_id":"d7d70b22-f8b1-43e8-ba2c-1dae1e596d28","resolution":{"observed_at":"2026-08-09T16:14:03.697700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1211.1550","last_updated":"2012-11-12T17:50:39Z","snapshot_observed_at":"2026-07-06T02:59:20.652044Z","submitted_at":"2012-11-07T13:49:26Z","title":"A Riemannian geometry for low-rank matrix completion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1211.1550","snapshot_observed_at":"2026-08-09T16:14:03.018238Z","title":"A., and Sepulchre, R","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.018238Z"},"links":{"cited_paper":"/paper/1211.1550","citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:5848f0289203d5eb50e48b67ce194c4d6f11301504da3cb1551a52094e36e25d","observation_id":"d01205e5-5778-403a-ab06-1c4a8ffc92b0","resolution":{"observed_at":"2026-08-09T16:14:03.018238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.682807Z","title":"A Theory of Non-Linear Feature Learning with One Gradient Step in Two-Layer Neural Networks","venue":null,"work_id":"777ce413-eac4-4a0e-9af2-4f2a1679061a","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.021747Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:adf1042dfae935da3ea8f77a15fa4f05964be13f1182297201108a2935dd0205","observation_id":"0f6e43e0-8d0b-4d36-9f01-88946a6ed686","resolution":{"observed_at":"2026-08-09T16:14:03.687093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.671376Z","title":"A Simplified Neuron Model as a Principal Component Analyzer","venue":null,"work_id":"39ac1c2c-8e23-47d0-a59c-58e9439756b5","year":1982},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.024993Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:49266606ff8b47d78b76c9167252911dc1503d431f30ebfca07dd3349c8b9deb","observation_id":"78bb1793-c050-4144-b60e-5d2916e1d605","resolution":{"observed_at":"2026-08-09T16:14:03.676259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.660924Z","title":"Pretrained Transformer Efficiently Learns Low-Dimensional Target Functions In-Context","venue":null,"work_id":"0259ad47-0fab-46de-8744-88876b5c4290","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.028390Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:629d279cb1df377554e83acb25b78a37544df0a83e6bc41d5b8c5b1035da3b1b","observation_id":"134a84d8-2010-4563-b8e6-2f02bdc6fa85","resolution":{"observed_at":"2026-08-09T16:14:03.664861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.031517Z","title":"Initialization using Update Approximation is a Silver Bullet for Extremely Efficient Low-Rank Fine-Tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.031517Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:cc7f09162795e3c94283bbacd8cbe9b91f9c2eb385c7e182c113f9204b98ed14","observation_id":"167604ef-acb0-461a-b34c-592b302f45bb","resolution":{"observed_at":"2026-08-09T16:14:03.031517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.650867Z","title":null,"venue":null,"work_id":"1f3aa56f-4983-4996-8d3f-f3f51b60dfd6","year":2020},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.035589Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:28c391f64af47b494da30b5805c5fec7801fd906f2a9ae2462787c7d6b2b0bd5","observation_id":"dc768797-f52e-4bce-8d14-c377b24005e1","resolution":{"observed_at":"2026-08-09T16:14:03.654583Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.641402Z","title":"Implicit Balancing and Regularization: Generalization and Convergence Guarantees for Overparameterized Asymmetric Matrix Sensing","venue":null,"work_id":"29517de2-0424-4be6-bf8b-e88124a5bc97","year":2023},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.038643Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:494ae0e5515e9af50be2efd0f2c505f48a85b8ed8e3c181bfbb87ee794c8a74e","observation_id":"5c3141fd-cbbe-4660-a4b4-96e47c1c54be","resolution":{"observed_at":"2026-08-09T16:14:03.645045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.631855Z","title":"and Soltanolkotabi, M","venue":null,"work_id":"562dda03-ade5-47bc-b6d4-3f3822a628cd","year":2021},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.041819Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:86068b99ca9b3a33c0640b5a7263caedffc528dfd3c00a1c842c2b3d323a3de0","observation_id":"34fc5355-9046-40b2-a90d-db59b6197ba2","resolution":{"observed_at":"2026-08-09T16:14:03.635190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.622484Z","title":null,"venue":null,"work_id":"00cfd5a7-700f-4ce1-ac00-120c54474965","year":2023},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.045107Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:44fb9315d2409d8dc06ebe3dd0bdd36d6c53365a979c8b86ad8e02e279aef7ae","observation_id":"f750e86f-5b98-49d8-beb4-12c6e515166e","resolution":{"observed_at":"2026-08-09T16:14:03.625772Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08239","snapshot_observed_at":"2026-08-09T16:14:03.048322Z","title":"LaMDA: Language Models for Dialog Applications","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.048322Z"},"links":{"cited_paper":"/paper/2201.08239","citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:106af10cc1e9ec369d1052b8f564d92d0cae60345799d56a38ad672ce881c87b","observation_id":"010b8d47-0f95-446f-a306-a7f0c24637f2","resolution":{"observed_at":"2026-08-09T16:14:03.048322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.612614Z","title":"Accelerating Ill-Conditioned Low-Rank Matrix Estimation via Scaled Gradient Descent","venue":null,"work_id":"5ebc1a83-5e0a-4a84-a221-e96666db97f5","year":2021},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.051733Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:4bb7254a3ca6cb2c23d9a81344b28acf2fd99e8895f752e204a868159e50dcd4","observation_id":"18b1a333-15c3-4df6-8443-3912d4cb1bf4","resolution":{"observed_at":"2026-08-09T16:14:03.616071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-09T16:14:03.054841Z","title":"LLaMA 2: Open Foundation and Fine-Tuned Chat Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.054841Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:d48e8f89085215457ed633c5d6f9954fb16e051a30c17da0d9d2d4ed0ca859fa","observation_id":"e268e7c8-f651-4b0a-b807-bc01c9b88fc3","resolution":{"observed_at":"2026-08-09T16:14:03.054841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1011.3027","last_updated":"2011-11-23T21:11:38Z","snapshot_observed_at":"2026-08-10T11:47:51.923745Z","submitted_at":"2010-11-12T20:20:28Z","title":"Introduction to the non-asymptotic analysis of random matrices","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1011.3027","snapshot_observed_at":"2026-08-09T16:14:03.058338Z","title":"Introduction to the non-asymptotic analysis of random matrices","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.058338Z"},"links":{"cited_paper":"/paper/1011.3027","citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:17f23dfba8356689628df3b94e0a0ac75d4f810c72b5a1aa833018c53826cf02","observation_id":"7f9fd1ed-d886-4024-b520-385b263de2a1","resolution":{"observed_at":"2026-08-09T16:14:03.058338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.602933Z","title":"High-Dimensional Probability: An Introduction with Applications in Data Science , volume 47","venue":null,"work_id":"85eb4ecc-6f08-4c41-a199-073a378bac68","year":2018},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.166240Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:19746e17e58eefcd526ed86617a9aaa74636e7f2830ccafe70deb91ca3017f1d","observation_id":"41c9f1f3-f119-4b9c-bc21-de003d2fa557","resolution":{"observed_at":"2026-08-09T16:14:03.606503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.592582Z","title":null,"venue":null,"work_id":"6bad4bea-2c83-499d-967c-4491b4be710d","year":2019},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.169785Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:14c36fc5fc0080fd20362f7b68f00abe9f1eae31c8a4318ec4b7f54e0e8504a8","observation_id":"c1f35182-d39b-48fb-9393-962dfe66543e","resolution":{"observed_at":"2026-08-09T16:14:03.596446Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.581988Z","title":"LoRA-GA: Low-Rank Adaptation with Gradient Approximation","venue":null,"work_id":"770bbfbb-873e-4a89-9940-67cfcc87c96f","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.173264Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:5c7551e4236334d662d907bb73d24f429869eec17c4aa030e41fb99e86bf5e50","observation_id":"efc7598d-937c-4a0c-a49d-5ffdd20b8165","resolution":{"observed_at":"2026-08-09T16:14:03.586059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.572235Z","title":"LoRA-Pro: Are Low-Rank Adapters Properly Optimized? In The Twelfth International Conference on Learning Representations, 2025","venue":null,"work_id":"b18d181b-bde7-46cd-988d-f50c2d8fae91","year":2025},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.176540Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:1aa6d1916aa0a75cc7c6815e62c221ba54ec7b54e85b1c9330f9af84d8bfa735","observation_id":"56fc75d1-1c56-4416-87cf-63106018aedd","resolution":{"observed_at":"2026-08-09T16:14:03.575882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.561535Z","title":"Perturbation bounds in connection with singular value decomposition","venue":null,"work_id":"5b832d59-db14-4074-8a71-891994bcf23d","year":1972},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.180337Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:43c430be900f114a39905b5cdc7526373c4fd82f24065d81213b75dece98963a","observation_id":"1b47c16e-2246-4008-817b-e1b8c69bf693","resolution":{"observed_at":"2026-08-09T16:14:03.565991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.550937Z","title":"V., Zhou, D., et al","venue":null,"work_id":"3945efd9-c35a-41c2-ae25-47587fec7638","year":2022},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.183411Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:2f52fa8d567aa341523d19a559929aa3f2f842e3a68c3a355cbabcaed3008ec8","observation_id":"de1421fa-a855-4c72-bb26-11ddf7b62211","resolution":{"observed_at":"2026-08-09T16:14:03.555098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.541543Z","title":null,"venue":null,"work_id":"9c823902-b7cd-4e5e-b960-972a5d973c9a","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.186530Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:c75490dee156fecc7279e7ab006e2c0cfc3f86bab8b9406104dd6bbe706fecca","observation_id":"42690d8a-29e6-46da-aaf3-796f06858e0b","resolution":{"observed_at":"2026-08-09T16:14:03.544734Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.531900Z","title":"The Power of Preconditioning in Overparameterized Low-Rank Matrix Sensing","venue":null,"work_id":"6f7f3187-5928-486c-90c3-b5918c849463","year":2023},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.190614Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:3f1fc1d052db53ffc181a8c1a555345e28dc6cf967103f0e2e0b538b9b093d8b","observation_id":"58d9cd03-889e-4b3d-ad87-2e83f3840ab1","resolution":{"observed_at":"2026-08-09T16:14:03.535267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.522380Z","title":"E., Luo, J., Tarmoun, S., Mallada, E., and Vidal, R","venue":null,"work_id":"f028c9a2-afc9-4ff7-96da-6997bdd02aed","year":2025},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.194132Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:486cd43b3bf0b465b165d582bcb68b92f16498462eeb4bcae46ae9c6295be54d","observation_id":"47cf46d9-5a47-405a-b85e-9d6ead32a7cd","resolution":{"observed_at":"2026-08-09T16:14:03.525744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.512158Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","venue":null,"work_id":"6a65351b-f28a-4892-a782-d782b3ba8aa4","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.197193Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:e511c93c0968e7d2eba5b4e9acf8a212dba0896d77934fad1604298b1097c0ec","observation_id":"f556bbbb-d468-4029-97b9-acddbc9e9f4b","resolution":{"observed_at":"2026-08-09T16:14:03.515757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.501288Z","title":"and Lee, K","venue":null,"work_id":"65cd5b4f-2b93-45ae-b79a-d26f11591d2d","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.201196Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:e923c99afadf0411b8e12033be2bddcb23259306ef83af0264824217d48dc949","observation_id":"b9fd354b-8649-45f2-b69c-c6d8a678fa24","resolution":{"observed_at":"2026-08-09T16:14:03.504847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.490423Z","title":"and Pilanci, M","venue":null,"work_id":"f353b6ec-9993-45fb-a692-4b65f146992e","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.204411Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:36d316a404b0ffe4f2965f48cb57c08225074979147b54a79127817d740db9f1","observation_id":"90295f17-eb6a-4516-8fba-f9427331ab91","resolution":{"observed_at":"2026-08-09T16:14:03.494160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.479814Z","title":null,"venue":null,"work_id":"03af2661-9b4d-49a6-b21d-c26fe82d1650","year":2023},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.207744Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:ccac7559ea1ff82d18da050d69931c3cd7b02ecb3333f852f78c75d204ba460b","observation_id":"d25f34b1-4d2d-400c-a371-7a55549d135b","resolution":{"observed_at":"2026-08-09T16:14:03.483887Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.468898Z","title":null,"venue":null,"work_id":"ee4e32d4-dc0a-4356-9dc8-ec03068355e3","year":2021},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.210944Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:942efab56b3df526df9ff41e73ac56eee1389e4274e3b2c040e2a61d02b0f554","observation_id":"d41c74c2-c68e-474e-afe1-32bab614e878","resolution":{"observed_at":"2026-08-09T16:14:03.473168Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.458608Z","title":"Y., Fu, J., Chen, W., and Yue, X","venue":null,"work_id":"e604eef3-b1e8-47bc-812d-58bc1a30f8ad","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.213968Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:e4ac919cff3891afb417d3603a36b92ec80939fdc5c7f1cb2bc30a6f8f6a84f7","observation_id":"e5ca940e-b758-407c-a6bb-33188f247185","resolution":{"observed_at":"2026-08-09T16:14:03.462272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T16:14:03.445778Z","title":"Imbalance-Regularized LoRA: A Plug-and-Play Method for Improving Fine-Tuning of Foundation Models","venue":null,"work_id":"d55d2a4a-2367-46d9-9d85-b84f71d8b651","year":2024},"citing_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-09T16:14:03.217184Z"},"links":{"citing_paper":"/paper/2502.01235"},"observation_digest":"sha256:5742543533fa7460199f4840f900918187929e4a11fed6885ffd290b12efdb51","observation_id":"09075420-d953-4799-b064-18baebc7f191","resolution":{"observed_at":"2026-08-09T16:14:03.451272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","latest_version":3,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":43},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 6 inbound Pith citation observations for arXiv:2502.01235."}