{"as_of":"2026-08-11T00:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:43fafc7c706d0feb41ba7b4a046f0b4cf32fb4fe0c48678f4a1e567981ff2d90","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T21:56:28.113429Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T02:14:38.644041Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T12:16:57.398617Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"cited_work":{"arxiv_id":"2502.09376","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09376","snapshot_observed_at":"2026-07-02T12:16:57.398617Z","title":"arXiv preprint arXiv:2502.09376 , year=","venue":null,"work_id":"47ee7338-4ba9-47f0-b152-5455c69a7071","year":2025},"citing_paper":{"arxiv_id":"2605.07959","last_updated":"2026-05-08T16:22:08Z","snapshot_observed_at":"2026-07-06T23:20:15.696237Z","submitted_at":"2026-05-08T16:22:08Z","title":"Convergent Stochastic Training of Attention and Understanding LoRA","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-11T02:48:35.907351Z"},"links":{"cited_paper":"/paper/2502.09376","citing_paper":"/paper/2605.07959"},"observation_digest":"sha256:5bedca913b0bb4bbac3bea24b397915d19c934bf929da3aface42a810747daaf","observation_id":"4ba7e21e-97fb-462b-a8b5-5eadba40b672","resolution":{"observed_at":"2026-05-11T03:05:55.048780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"cited_work":{"arxiv_id":"2502.09376","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09376","snapshot_observed_at":"2026-07-02T12:16:57.398617Z","title":"arXiv preprint arXiv:2502.09376 , year=","venue":null,"work_id":"47ee7338-4ba9-47f0-b152-5455c69a7071","year":2025},"citing_paper":{"arxiv_id":"2606.05899","last_updated":"2026-06-04T09:05:59Z","snapshot_observed_at":"2026-07-06T23:45:51.910263Z","submitted_at":"2026-06-04T09:05:59Z","title":"High-Dimensional Theory of LoRA Fine-Tuning in a Solvable Attention Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T02:14:38.644041Z"},"links":{"cited_paper":"/paper/2502.09376","citing_paper":"/paper/2606.05899"},"observation_digest":"sha256:5ee3bdc3263f020d14b6f39a64ed7646356ce0b1411131d1bd9a28b13c3af6fb","observation_id":"0c9f8c0a-a952-4bc6-a56e-9d6b44369933","resolution":{"observed_at":"2026-07-02T12:16:57.400233Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.09376/citation-record","integrity":"/paper/2502.09376/integrity","json":"/paper/2502.09376/citation-record.json","paper":"/paper/2502.09376"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:27.899907Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.899907Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:fbec3c2740fd1b19d1df29b80d2de59a1ba24a44ed86e9342116c9ee66f4eac9","observation_id":"e692fd8d-1ba8-49e4-b864-3ed36e885fa7","resolution":{"observed_at":"2026-08-07T21:56:27.899907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.807500Z","title":"Intrinsic dimensionality explains the effectiveness of language model fine-tuning","venue":null,"work_id":"4c1bd97c-5ff6-4d53-94e3-28f8ed5e0e1a","year":2021},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.906207Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:ea763078a068c65494b89bdeb6cab7ade474c3f5980b90e713d4b437f0cb99ef","observation_id":"5f35f5a6-f48e-423f-a14d-9becfefb8db4","resolution":{"observed_at":"2026-08-07T21:56:28.812312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.792193Z","title":"B it F it: Simple parameter-efficient fine-tuning for transformer-based masked language-models","venue":null,"work_id":"0550c707-a05e-43bc-8644-54aa4295ddb2","year":2022},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.911127Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:2294ea66ae1d833902f3bb7ba6af57278999ec7a3e7743fdc475f814368d43b9","observation_id":"354e09e1-7b1e-4b23-96e6-2ddfaf24f344","resolution":{"observed_at":"2026-08-07T21:56:28.797593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.777506Z","title":"Global optimality of local search for low rank matrix recovery","venue":null,"work_id":"f17b3df0-8e96-4863-94c5-02638a6f3b86","year":2016},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.916668Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:9e379df7e911eaf9452407abfcf0dbcb6ffbe1c75afbf81abf5f6d84cae46d1b","observation_id":"fd86df65-7367-445a-9fbe-0ae25ad9de1a","resolution":{"observed_at":"2026-08-07T21:56:28.782377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.762622Z","title":"and Monteiro, R","venue":null,"work_id":"989dd37f-5aae-4997-8b42-de041f8cccb4","year":2003},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.922243Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:7454c9f600a84b0e1266a4a8d2e5881543a9e3c96fb4f493aaa6cffe52a63839","observation_id":"cd6d59e4-768d-4e1d-8ef3-3e13a64bbe81","resolution":{"observed_at":"2026-08-07T21:56:28.767377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.748287Z","title":"P., and Bernardino, A","venue":null,"work_id":"b07bb2c2-df65-490f-abef-351b0e9313d1","year":2013},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.927203Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:790d9ddaa7846952acad6a42ea7c6fd6acf4d8cf6826b4648dbebb8d24baa958","observation_id":"e06c3974-09de-4777-b4ff-e8b1bff34cc0","resolution":{"observed_at":"2026-08-07T21:56:28.752771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.734136Z","title":"and Recht, B","venue":null,"work_id":"c4be151e-f7b1-4efd-a5ec-ad8df8012eca","year":2012},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.932414Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:4c6855e3f1942abd7501deccf932d11c0015620cc6a23d7a6b1951874dd14d14","observation_id":"3e580b70-3f66-4966-82aa-c68ca4231d37","resolution":{"observed_at":"2026-08-07T21:56:28.738862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15385","last_updated":"2024-11-23T00:00:28Z","snapshot_observed_at":"2026-07-06T19:55:51.415524Z","submitted_at":"2024-11-23T00:00:28Z","title":"Gradient dynamics for low-rank fine-tuning beyond kernels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15385","snapshot_observed_at":"2026-08-07T21:56:27.937594Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.937594Z"},"links":{"cited_paper":"/paper/2411.15385","citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:43fcc029aa48845af021d556bc633cc9af5d6d0cb242fc69362fa3b6e6ac9e8b","observation_id":"98c220fe-5550-4078-a9af-aa78bbf0f120","resolution":{"observed_at":"2026-08-07T21:56:27.937594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.719696Z","title":"QL o RA : Efficient finetuning of quantized LLM s","venue":null,"work_id":"6af932b2-6072-491a-aec2-1c96fa7d3200","year":2023},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.942697Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:75b016429684f127e0c16a201386722da125f0a5a72017728b7081711ed45b96","observation_id":"0114dca8-2941-4a94-b09b-38435dd18298","resolution":{"observed_at":"2026-08-07T21:56:28.724370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.704301Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"5c60594c-12f4-443d-9926-9fca073f4047","year":2021},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.947515Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:52914ef00f94bfdbacf6b62ccdf2c04a0b8892cdeb85f11b0705e61e7412b26b","observation_id":"7e6d0f35-5b82-448b-aafe-d56d436a9f58","resolution":{"observed_at":"2026-08-07T21:56:28.709190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.689386Z","title":null,"venue":null,"work_id":"35c87296-0624-466a-b2ca-b98b53faab4c","year":2001},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.952364Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:05a7e718bf8a368706653939b2810c08b4ad16567a75ec5e0c1294f4df177dd0","observation_id":"c50a52c0-0a2a-49b6-8ca3-f88ec042fcdc","resolution":{"observed_at":"2026-08-07T21:56:28.694097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.674540Z","title":"S., Gupte, A., and Poggio, T","venue":null,"work_id":"15e3d878-a444-40f7-8134-2ce32bf6a728","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.957464Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:e0cb7eba44c29fa5feafaf9ca848b889e97ac68c459363cfb7a972ece1c97d81","observation_id":"cae99a14-a724-42e8-a266-1b6ac3e5f5ec","resolution":{"observed_at":"2026-08-07T21:56:28.679582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.659388Z","title":"Escaping from saddle points --- online stochastic gradient for tensor decomposition","venue":null,"work_id":"dc0ff1aa-0db0-4dbe-b963-6c982393cd41","year":2015},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.962169Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:d37366abfabb27eff0906cdb532a0ec5eaef725c1a7eea0f331102211ca4da22","observation_id":"91e3008a-c7d3-4b87-94dc-9340e658ead4","resolution":{"observed_at":"2026-08-07T21:56:28.664330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.643451Z","title":"No spurious local minima in nonconvex low rank problems: A unified geometric analysis","venue":null,"work_id":"c01b3c2d-d9aa-4458-abc6-87876e123232","year":2017},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.967014Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:a9fcf00ccf9bb43f67f00ccd8720947f786b742a7f6da60682cbdeb735b8474a","observation_id":"017794ee-b27e-40d0-80fe-647da8a56313","resolution":{"observed_at":"2026-08-07T21:56:28.648522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.627304Z","title":null,"venue":null,"work_id":"e0bfdb3f-f30f-4e26-87c0-00fd32759185","year":2020},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.971546Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:840d2ea8eff1a75aa46880396d873cd4297ea791af7454fc8d22aa2dada1cc0d","observation_id":"12ac7549-30c7-4280-8023-943184755ac3","resolution":{"observed_at":"2026-08-07T21:56:28.632480Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.611119Z","title":"LoRA+ : efficient low rank adaptation of large models","venue":null,"work_id":"791d1b24-60ce-463e-a4c8-aee084386453","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.976368Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:999204dde9162cfbb103089f9062da28d569e36efce5497cb6e520dc50c12660","observation_id":"62ab7258-c005-4f8e-8ebc-cd993b190924","resolution":{"observed_at":"2026-08-07T21:56:28.616156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.596089Z","title":"J., yelong shen, Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":"b8979996-5481-4ab1-b290-f58379686f68","year":2022},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.981130Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:19b5629caa81018cd488d18ec8140b4c140d7299a2809e35a63e4070d340c4f6","observation_id":"9d39d05b-8049-47b0-bacb-1de7a9f080a9","resolution":{"observed_at":"2026-08-07T21:56:28.601034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.580792Z","title":"Low Rank Regularization : A review","venue":null,"work_id":"67fc55b4-ba98-4800-a158-dbf7d16a2d3e","year":2021},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.985546Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:e8b3bb7b9becc72bdb8e3f53ca755e8e0f419d082cc0e472eb42b70ebcc3b2fa","observation_id":"30783878-c28c-4028-86a6-674d4354f617","resolution":{"observed_at":"2026-08-07T21:56:28.585418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.566052Z","title":"D., and Ryu, E","venue":null,"work_id":"fb1cb110-aab4-408a-b9ea-c2a9371b3eb1","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.990523Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:f485d60ded82b02260ec5516eb6562dd73510df91ddaf87ec5d8f8dcaf8f0125","observation_id":"4fab97aa-446b-4d8d-a51d-f0c629f4c786","resolution":{"observed_at":"2026-08-07T21:56:28.570896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03732","last_updated":"2023-11-28T03:23:20Z","snapshot_observed_at":"2026-08-08T21:34:35.024914Z","submitted_at":"2023-11-28T03:23:20Z","title":"A Rank Stabilization Scaling Factor for Fine-Tuning with LoRA","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03732","snapshot_observed_at":"2026-08-07T21:56:27.995531Z","title":"A rank stabilization scaling factor for fine-tuning with LoRA","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:27.995531Z"},"links":{"cited_paper":"/paper/2312.03732","citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:9f76222af8cca77a327e04f1a14493c67c76b422a17d5b156be75f6894d36315","observation_id":"416b7158-9c77-4b75-acdb-502bbb439a5b","resolution":{"observed_at":"2026-08-07T21:56:27.995531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.550956Z","title":null,"venue":null,"work_id":"373c260c-f02f-4a0b-8f27-9bc7a1acd714","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.000578Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:a1cb7dd59246a01cdb80b09b91a3c2a2a487fffbbd860de463e14b5ca4a78c72","observation_id":"0ff75e8d-3568-4ada-b755-63560221e9ba","resolution":{"observed_at":"2026-08-07T21:56:28.555961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.005302Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.005302Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:879c383ff4ae4f09497f91ab694c4673994d49a254222b5a448f5fbeb8870298","observation_id":"ada2276f-4090-4e46-9bee-6286ed4e5a13","resolution":{"observed_at":"2026-08-07T21:56:28.005302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.526372Z","title":"D., Simchowitz, M., Jordan, M","venue":null,"work_id":"9bfb3fd0-b0e7-4b3c-bb61-1476c02783bd","year":2016},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.009859Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:98cc68714b4835096b821473c793efa4654ddfcaaf0ed7ba8e5c4681d02152ac","observation_id":"5de2cea3-9444-4f8c-93e7-2b4bdf7810d5","resolution":{"observed_at":"2026-08-07T21:56:28.530964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.511706Z","title":"The power of scale for parameter-efficient prompt tuning","venue":null,"work_id":"6f62e8fc-9cd8-4c65-86c7-d4f2d54ef993","year":2021},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.014448Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:31e0dc6a4f080844cd7732a6b4bafa83a8134e46b75677f3cf544992159ea5e5","observation_id":"a38e8f7e-12c7-43a7-a56b-2f63d781f076","resolution":{"observed_at":"2026-08-07T21:56:28.516380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.497032Z","title":"Measuring the intrinsic dimension of objective landscapes","venue":null,"work_id":"ac2e927f-9554-4b90-8ff9-fadc66d5746c","year":2018},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.020191Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:ea092da827cb4fe27fa3f9c549c13b51f966f3cc7d2465a0614cbe9cb135ea2c","observation_id":"fe869634-a126-4574-b228-e538d3b8d1fd","resolution":{"observed_at":"2026-08-07T21:56:28.501808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.482277Z","title":null,"venue":null,"work_id":"5939e5a5-add7-4c64-b039-4116a726ab3e","year":2021},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.024841Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:46ff72bf49f03b1003566b095fcbfa256cf74800ccd6f735ec22752ee5f39f65","observation_id":"a885dbf8-3e97-4355-b330-55683f191372","resolution":{"observed_at":"2026-08-07T21:56:28.487069Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.466842Z","title":"A kernel-based view of language model fine-tuning","venue":null,"work_id":"cca79856-084a-45fa-8493-0b4b515adff8","year":2023},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.029568Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:7b7d489b99099492f5fbc4283890f351ab48c9e39bd56f32efbbf5c974769ca8","observation_id":"62e0fc89-f368-43b7-9052-d4add531312a","resolution":{"observed_at":"2026-08-07T21:56:28.471798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.451460Z","title":"Pi SSA : Principal singular values and singular vectors adaptation of large language models","venue":null,"work_id":"a138a68b-7d2c-41f4-9d45-e7e22c7bc125","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.034518Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:03e8e74af97b619107dd88f439fe3733ea02bac1d81707fba04a66af649d927c","observation_id":"01321cd3-d9b4-4f00-872b-47263ca9aadb","resolution":{"observed_at":"2026-08-07T21:56:28.456540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.434987Z","title":null,"venue":null,"work_id":"89cade65-4aa4-4d37-b0ac-c6174a635e64","year":1995},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.039307Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:107a606813f4360dbcd66a2d7ddf62a3fcaf355039f1799a62c4c021b43def0c","observation_id":"53222814-a074-4fe6-bb97-c9f8ece95353","resolution":{"observed_at":"2026-08-07T21:56:28.440247Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.419488Z","title":"and Boyd, S","venue":null,"work_id":"37dff93b-3c97-40b8-961f-5a4a73861411","year":2014},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.044281Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:0abb55a2c2549459cc59b4aa5c94891b0d51defdef890caf1de70dc2fbefd154","observation_id":"c86a463b-5ff5-4562-9603-1fd1fc82901a","resolution":{"observed_at":"2026-08-07T21:56:28.424465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.403010Z","title":"Non-square matrix sensing without spurious local minima via the B urer-- M onteiro approach","venue":null,"work_id":"d2f3c150-5133-4b82-be94-5f6ee47d2d00","year":2017},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.048937Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:098d2e8d2129b95821ac35bae8f207aeafdcfaeb79c2bd119bfbc77435d54558","observation_id":"3375a43c-ca55-4edf-9cc8-502f574c0119","resolution":{"observed_at":"2026-08-07T21:56:28.408667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.387944Z","title":null,"venue":null,"work_id":"a6398c1e-85f2-4922-946b-7375c5d84036","year":2010},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.053630Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:b070ea515f049956eb1305e1814b51d0411092702b9b1c0bf9c272a4cb2fd008","observation_id":"8889ed63-315e-44d9-adf7-ad019701345c","resolution":{"observed_at":"2026-08-07T21:56:28.392727Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.370279Z","title":"D., Ng, A., and Potts, C","venue":null,"work_id":"c3411920-e27e-40c4-b121-b6f2ffc1b307","year":2013},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.058145Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:94ed6bdd6fa0cc3d5d934b6a9500f1920b0a60773acf74bd06f3c3fc20985a76","observation_id":"ac0b48d3-9b3b-4e98-8fd6-b7b68f15536d","resolution":{"observed_at":"2026-08-07T21:56:28.375214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.355596Z","title":"and Sato, I","venue":null,"work_id":"1dac31b6-b8a2-4516-9f6d-ce142256744f","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.062756Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:cf70c1d99b87eb0cf78d36e1ff0c3918de52e31402c1186c9a1bda6b70f8a6c6","observation_id":"b3e8238e-5eb3-4d94-b243-d2f9cc0d6c99","resolution":{"observed_at":"2026-08-07T21:56:28.360267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.340348Z","title":"GLUE : A multi-task benchmark and analysis platform for natural language understanding","venue":null,"work_id":"f7f3e9ab-6207-4ad2-a04d-9a331d93ba48","year":2018},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.067134Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:5d3b4260bca5e6c2f26b2852a9f9f98f43589d2987f65b18fffb43418d70ceaf","observation_id":"b40947ee-a377-45cb-a724-b6f05e57a5ec","resolution":{"observed_at":"2026-08-07T21:56:28.345341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.324714Z","title":"M i L o RA : Harnessing minor singular components for parameter-efficient LLM finetuning","venue":null,"work_id":"5b3d4518-096d-4012-810f-f6ca11475084","year":2025},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.071846Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:3eeea8bcf7fb10bfd3610ab0aee7561cdcbca8be0784953a86a8914cb3da4279","observation_id":"477deed3-5f96-4764-a0a5-4a4a73a674d5","resolution":{"observed_at":"2026-08-07T21:56:28.329656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.308899Z","title":"and Jacot, A","venue":null,"work_id":"95d8a0d0-0756-444a-8b12-e87bbfa4c145","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.076380Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:8b991478bce738a54952f5bdaff9c966bf1ff165255fc430a5153e0aab81618b","observation_id":"f8ca8107-1019-441d-bed4-f323b40f5527","resolution":{"observed_at":"2026-08-07T21:56:28.314361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.293107Z","title":"How over-parameterization slows down gradient descent in matrix sensing: The curses of symmetry and initialization","venue":null,"work_id":"b4a53c03-e385-41ee-9eb0-77a89ea7aa3c","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.081070Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:b731bf518b56331a8cef0c7cb14e2548e6260bb4f499fa1d52a02854150ad424","observation_id":"85f87de4-738a-4589-b1fc-ec1091800e4a","resolution":{"observed_at":"2026-08-07T21:56:28.298215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.277132Z","title":"and Du, S","venue":null,"work_id":"ed47137a-3ddc-4358-b6fd-898f7c7d84d1","year":2023},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.085615Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:c2c68e9f26690edf237c3e1977fc3daf10fbf58e1980cf2cbc5b6490b7e81f54","observation_id":"de271249-a669-44dd-a697-090ff8b481f9","resolution":{"observed_at":"2026-08-07T21:56:28.281989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.260713Z","title":"and Lee, K","venue":null,"work_id":"d576a2d8-e5e9-4617-9fde-4f06b0ec7fab","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.090302Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:1e5e3b0ed1a382e8a9a24523e50fa97ce8b8389194bcb852ef57a4dc1237ccb3","observation_id":"c9409d36-1580-4f62-9fe4-d2cde2b899c8","resolution":{"observed_at":"2026-08-07T21:56:28.265706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10790","last_updated":"2025-05-06T17:29:39Z","snapshot_observed_at":"2026-08-10T08:10:42.588610Z","submitted_at":"2021-04-21T23:07:18Z","title":"Sharp Global Guarantees for Nonconvex Low-rank Recovery in the Noisy Overparameterized Regime","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10790","snapshot_observed_at":"2026-08-07T21:56:28.094778Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.094778Z"},"links":{"cited_paper":"/paper/2104.10790","citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:4fc52fa04b41c43748d0886b23d02055e05940014439051153709566f34a083c","observation_id":"85bf6b30-e480-4139-9ae0-99e21e6a5400","resolution":{"observed_at":"2026-08-07T21:56:28.094778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.245355Z","title":null,"venue":null,"work_id":"25b75efc-d535-4147-9320-8ad6eb9043ef","year":2024},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.099545Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:4dd08f0314143a8fecc4845fe24338bac168be2ac381d42cc849f795ad7b9ea9","observation_id":"224d6510-8743-4e55-a701-f9e367683784","resolution":{"observed_at":"2026-08-07T21:56:28.250106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01235","last_updated":"2025-06-23T09:29:57Z","snapshot_observed_at":"2026-08-09T15:55:13.459556Z","submitted_at":"2025-02-03T10:50:03Z","title":"LoRA-One: One-Step Full Gradient Could Suffice for Fine-Tuning Large Language Models, Provably and Efficiently","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01235","snapshot_observed_at":"2026-08-07T21:56:28.103866Z","title":"One-step full gradient suffices for low-rank fine-tuning, provably and efficiently","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.103866Z"},"links":{"cited_paper":"/paper/2502.01235","citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:cdf51f3f51f21cb922137591a4b865ab4964897ba54745550b75593947570b6d","observation_id":"697a3dbe-9bbf-4765-b1d1-41004303ff33","resolution":{"observed_at":"2026-08-07T21:56:28.103866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.229753Z","title":null,"venue":null,"work_id":"34fa4bc5-f0e1-4e1a-8aa5-a17b6356fb78","year":2018},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.109040Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:4f2f30ee76644235b76cddffdccb19eef115d40f59acf9e7d23c7942ad1eaf0a","observation_id":"54a33de9-664a-46f0-b306-8939139093f2","resolution":{"observed_at":"2026-08-07T21:56:28.234701Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:56:28.211682Z","title":"A robustly optimized BERT pre-training approach with post-training","venue":null,"work_id":"d40f8111-1a58-4ba7-b845-b67c24391a8d","year":2021},"citing_paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T21:56:28.113429Z"},"links":{"citing_paper":"/paper/2502.09376"},"observation_digest":"sha256:d087559ba9880149115c0090b2519a55042dd4177e614ffcd1dfce8bf608fc15","observation_id":"60523968-22e0-4d39-ab4c-e74ca3149161","resolution":{"observed_at":"2026-08-07T21:56:28.218464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.09376","last_updated":"2025-06-03T01:42:41Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T07:38:47.401063Z","submitted_at":"2025-02-13T14:45:11Z","title":"LoRA Training Provably Converges to a Low-Rank Global Minimum or It Fails Loudly (But it Probably Won't Fail)"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 2 inbound Pith citation observations for arXiv:2502.09376."}