{"as_of":"2026-08-08T18:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7c0752cc714bd8dfaa54d44a450516741b1192495ff10bb6b5cdabc5e6d014ca","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":45,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T13:31:42.061884Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:30:07.259186Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-08T13:31:42.061884Z","title":"Lora learns less and forgets less","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07222","last_updated":"2025-02-11T03:32:10Z","snapshot_observed_at":"2026-08-08T13:23:06.239630Z","submitted_at":"2025-02-11T03:32:10Z","title":"A Memory Efficient Randomized Subspace Optimization Method for Training Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T13:31:42.061884Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2502.07222"},"observation_digest":"sha256:c0ed166349c7cde90a41300da26fb0a39c51bb7bcdef7b9e0d2f6545b57a6a5e","observation_id":"9ba0fd91-1273-4f46-8c25-048b37646563","resolution":{"observed_at":"2026-08-08T13:31:42.061884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-08T11:51:09.948149Z","title":"Lora learns less and forgets less","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07739","last_updated":"2025-05-26T08:53:14Z","snapshot_observed_at":"2026-08-08T11:40:44.827344Z","submitted_at":"2025-02-11T17:59:35Z","title":"HRP: High-Rank Preheating for Superior LoRA Initialization","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:09.948149Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2502.07739"},"observation_digest":"sha256:f963d60ef5faa997aef86035c0f8b5a3cffb939b502c26c9212ce413d2ec201c","observation_id":"9ca2d721-629a-4124-bc2b-51d635eccc00","resolution":{"observed_at":"2026-08-08T11:51:09.948149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-07T14:45:58.468305Z","title":"Lora learns less and forgets less.arXiv preprint arXiv:2405.09673, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17872","last_updated":"2025-05-27T07:23:28Z","snapshot_observed_at":"2026-08-08T06:53:10.432858Z","submitted_at":"2025-05-23T13:24:39Z","title":"Mixture of Low Rank Adaptation with Partial Parameter Sharing for Time Series Forecasting","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:45:58.468305Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2505.17872"},"observation_digest":"sha256:36d44f2f870698aae80c0e842df8f70e86b577aaa3bbf1e64f227533f158c185","observation_id":"0b757c5f-ed2f-46f4-b935-a6d1f812e0d1","resolution":{"observed_at":"2026-08-07T14:45:58.468305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-07T13:00:54.044434Z","title":"Lora learns less and forgets less","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23099","last_updated":"2025-05-29T05:03:29Z","snapshot_observed_at":"2026-08-07T12:50:57.857673Z","submitted_at":"2025-05-29T05:03:29Z","title":"Weight Spectra Induced Efficient Model Adaptation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:54.044434Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2505.23099"},"observation_digest":"sha256:4f746f9e1035434826365a10b68dc52e1a6ba94840859c1c1d593087d5a68947","observation_id":"f39f8234-2171-4e98-94b7-cc38e0e439f0","resolution":{"observed_at":"2026-08-07T13:00:54.044434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-07T12:41:42.678829Z","title":"Lora learns less and forgets less.arXiv preprint arXiv:2405.09673,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24037","last_updated":"2026-06-02T09:33:40Z","snapshot_observed_at":"2026-08-07T12:35:11.815263Z","submitted_at":"2025-05-29T22:17:43Z","title":"Leave it to the Specialist: Repair Sparse LLMs with Sparse Fine-Tuning via Sparsity Evolution","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T12:41:42.678829Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2505.24037"},"observation_digest":"sha256:b7972f98d3e8b6914133b362f118606576c432884952d1db5afa0f060697319b","observation_id":"8853e61d-0af8-48ca-88e0-68ab432e5ca3","resolution":{"observed_at":"2026-08-07T12:41:42.678829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-07T04:46:48.781646Z","title":"Lora learns less and forgets less,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09800","last_updated":"2025-06-11T14:42:11Z","snapshot_observed_at":"2026-08-07T04:37:42.112084Z","submitted_at":"2025-06-11T14:42:11Z","title":"Reinforced Refinement with Self-Aware Expansion for End-to-End Autonomous Driving","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T04:46:48.781646Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2506.09800"},"observation_digest":"sha256:972a914767da9ad1f2ff031fc408259149eaf155d27145fdce6b9efd7ab0e2e0","observation_id":"ec704b60-cc43-4062-8e63-9904645018cd","resolution":{"observed_at":"2026-08-07T04:46:48.781646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-07T04:33:16.824450Z","title":"LoRA learns less and forgets less","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10424","last_updated":"2025-06-12T07:23:56Z","snapshot_observed_at":"2026-08-08T16:23:05.158098Z","submitted_at":"2025-06-12T07:23:56Z","title":"SOFT: Selective Data Obfuscation for Protecting LLM Fine-tuning against Membership Inference Attacks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:33:16.824450Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2506.10424"},"observation_digest":"sha256:50ffc48180effaf58b3c44ede11dc64756bc48f4131441cb4d1787338a89b444","observation_id":"81debbcb-920e-402d-9cd5-a06f9378196f","resolution":{"observed_at":"2026-08-07T04:33:16.824450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-07T00:58:07.753430Z","title":"Biderman, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12394","last_updated":"2025-06-14T08:19:11Z","snapshot_observed_at":"2026-08-07T00:48:44.612760Z","submitted_at":"2025-06-14T08:19:11Z","title":"LARGO: Low-Rank Regulated Gradient Projection for Robust Parameter Efficient Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:58:07.753430Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2506.12394"},"observation_digest":"sha256:8dfb7f5b6136fbdad78c93f68c3a9964ec18c1340ff125144fd0098bb7b15ee9","observation_id":"b6d09532-d057-4891-8f53-0655b59e8902","resolution":{"observed_at":"2026-08-07T00:58:07.753430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-07T00:25:29.109933Z","title":"LoRA learns less and forgets less.arXiv:2405.09673, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14280","last_updated":"2025-06-17T07:49:43Z","snapshot_observed_at":"2026-08-07T00:15:47.470312Z","submitted_at":"2025-06-17T07:49:43Z","title":"Improving LoRA with Variational Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:29.109933Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2506.14280"},"observation_digest":"sha256:b75ceec839a05bff8fc338699b2411568bc1372c3f98ec5c5a289a09dd0cbd10","observation_id":"14426df0-6280-47e0-a207-c0cedd8e3f42","resolution":{"observed_at":"2026-08-07T00:25:29.109933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2506.21035","last_updated":"2026-05-29T11:08:12Z","snapshot_observed_at":"2026-08-06T22:32:52.062894Z","submitted_at":"2025-06-26T06:19:05Z","title":"Little by Little: Continual Learning via Incremental Mixture of Rank-1 Associative Memory Experts","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T13:06:03.463520Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2506.21035"},"observation_digest":"sha256:930dfada02385555ff694282fecbe613b27f7de1d901d7b4e88c3fad5923b52f","observation_id":"1e65f524-9e20-4268-8ab5-13b10ef954ea","resolution":{"observed_at":"2026-05-22T13:06:34.490696Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2507.00029","last_updated":"2026-05-13T05:28:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-17T14:58:54Z","title":"LoRA-Mixer: Coordinate Modular LoRA Experts Through Serial Attention Routing","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-19T09:05:25.236355Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2507.00029"},"observation_digest":"sha256:bf68dea68d5ad2fefbcaf33ac35390b426703ca34c644437cb14ba5eb4d6cf12","observation_id":"20c43223-189f-4a17-ad9b-5a326f670867","resolution":{"observed_at":"2026-05-19T09:07:14.613606Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-06T20:58:54.519614Z","title":"Cunningham","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01438","last_updated":"2025-07-02T07:47:28Z","snapshot_observed_at":"2026-08-06T20:49:01.786008Z","submitted_at":"2025-07-02T07:47:28Z","title":"EdgeLoRA: An Efficient Multi-Tenant LLM Serving System on Edge Devices","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:58:54.519614Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2507.01438"},"observation_digest":"sha256:2fbe4f970352f2d45d21ebf7da81860852c74ec690df71cff97b8c30a778f925","observation_id":"4d43623f-5c82-4dd4-a34d-e46eaa4c9d66","resolution":{"observed_at":"2026-08-06T20:58:54.519614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-06T15:24:25.120353Z","title":"Lora learns less and forgets less.arXiv preprint arXiv:2405.09673,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16116","last_updated":"2026-05-26T15:21:27Z","snapshot_observed_at":"2026-08-06T15:15:40.031886Z","submitted_at":"2025-07-22T00:09:37Z","title":"Pusa V1.0: Unlocking Temporal Control in Pretrained Video Diffusion Models via Vectorized Timestep Adaptation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:24:25.120353Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2507.16116"},"observation_digest":"sha256:09192af89a784e50be774fe3745213fc2f5a39e772c79b5f606eaa7a34f5be40","observation_id":"c44ca49e-ab63-4bf9-b64d-41bde8dfdbf5","resolution":{"observed_at":"2026-08-06T15:24:25.120353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2508.04227","last_updated":"2026-07-30T06:04:42Z","snapshot_observed_at":"2026-08-06T00:51:46.397179Z","submitted_at":"2025-08-06T09:03:10Z","title":"Continual Learning for VLMs: A Survey and Taxonomy Beyond Forgetting","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-21T23:41:54.385864Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2508.04227"},"observation_digest":"sha256:606107e7d2b1ffe58fd216c30e46ea9da7b393677d38a407dab42f2361572230","observation_id":"de5c4c14-32a8-4ed0-9ff1-eb2a6b496bf0","resolution":{"observed_at":"2026-05-21T23:44:26.924212Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-06T00:51:57.865153Z","title":"Lora learns less and forgets less,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04227","last_updated":"2026-07-30T06:04:42Z","snapshot_observed_at":"2026-08-06T00:51:46.397179Z","submitted_at":"2025-08-06T09:03:10Z","title":"Continual Learning for VLMs: A Survey and Taxonomy Beyond Forgetting","version":3},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T00:51:57.865153Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2508.04227"},"observation_digest":"sha256:338f07912293ce69265e776026c462495868b1902e3606a9d6e3ca33bdb32fd4","observation_id":"b0b01936-b29f-4e1c-a222-3a50791802e9","resolution":{"observed_at":"2026-08-06T00:51:57.865153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-05T23:54:27.028906Z","title":"Lora learns less and forgets less,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-07T08:41:39.799728Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T23:54:27.028906Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2508.04676"},"observation_digest":"sha256:969c24640f355e96fdaf5ac505e83a59ad20c7e8488efd7c1894f5c569bdd060","observation_id":"20f7bc87-c7a9-4749-ab6c-1aeba422fb72","resolution":{"observed_at":"2026-08-05T23:54:27.028906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2509.18993","last_updated":"2026-05-13T13:30:21Z","snapshot_observed_at":"2026-08-02T18:52:22.902766Z","submitted_at":"2025-09-23T13:43:02Z","title":"CR-Net: Scaling Parameter-Efficient Training with Cross-Layer Low-Rank Structure","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T14:51:30.312509Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2509.18993"},"observation_digest":"sha256:dde5bd0b982efb4a2784a75a23ac826c3b892705eaea69c63b9a8c83a3e155a8","observation_id":"db826248-cd26-4939-aa4e-1e27d1e11c92","resolution":{"observed_at":"2026-05-18T14:52:41.329091Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2512.21788","last_updated":"2026-05-03T22:31:54Z","snapshot_observed_at":"2026-08-03T16:27:21.158436Z","submitted_at":"2025-12-25T21:37:12Z","title":"InstructMoLE: Instruction-Guided Mixture of Low-rank Experts for Multi-Conditional Image Generation","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T19:10:47.425041Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2512.21788"},"observation_digest":"sha256:dd0377cc2a1c92bc08903d4e2e037fe972551f37806e44823b3ca49b7efb83e0","observation_id":"01fbab61-b68c-488f-b23e-0248db9cfd1d","resolution":{"observed_at":"2026-05-16T19:11:11.502238Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2602.08813","last_updated":"2026-05-12T17:22:35Z","snapshot_observed_at":"2026-08-06T12:22:42.069570Z","submitted_at":"2026-02-09T15:50:05Z","title":"Robust Policy Optimization to Prevent Catastrophic Forgetting","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T05:33:42.965249Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2602.08813"},"observation_digest":"sha256:b423faad68d171f514ad18769f8f2cc5d93be1b3b2d4cd4c56bbe91a2a6cc845","observation_id":"cb46b6ba-5ba2-4736-a388-6ce7d144ba22","resolution":{"observed_at":"2026-05-16T05:37:24.414444Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-03T09:45:41.335752Z","title":"Lora learns less and forgets less.arXiv preprint arXiv:2405.09673,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11171","last_updated":"2026-05-28T09:44:38Z","snapshot_observed_at":"2026-08-03T09:45:40.462025Z","submitted_at":"2026-01-19T08:48:03Z","title":"A Language-Guided Bayesian Optimization for Efficient LoRA Hyperparameter Search","version":2},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-03T09:45:41.335752Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2602.11171"},"observation_digest":"sha256:b5efb9a7dd5c44df3506809dd7f69179648f82ae313c9f663327b0efb28a9cf8","observation_id":"3197ec90-b3f5-4e98-a529-37e2f4d76105","resolution":{"observed_at":"2026-08-03T09:45:41.335752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-13T14:28:05.261852Z","title":"Lora learns less and forgets less.arXiv preprint arXiv:2405.09673,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.01313","last_updated":"2026-07-13T21:14:32Z","snapshot_observed_at":"2026-08-05T01:00:36.896864Z","submitted_at":"2026-04-01T18:36:47Z","title":"ScatterPrism: convergence for generative simulation and inverse problems in particle and nuclear physics","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T14:28:05.261852Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2604.01313"},"observation_digest":"sha256:5ce54f7956d8f3fa8b5039b686f62f7f457b02f28a8fd0189fe1c87f92d1b77a","observation_id":"8c45b8cf-d40e-487e-be91-7afb63a9f21d","resolution":{"observed_at":"2026-07-13T14:28:05.261852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-15T11:44:19.622453Z","title":"Lora learns less and forgets less.arXiv preprint arXiv:2405.09673,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.01313","last_updated":"2026-07-13T21:14:32Z","snapshot_observed_at":"2026-08-05T01:00:36.896864Z","submitted_at":"2026-04-01T18:36:47Z","title":"ScatterPrism: convergence for generative simulation and inverse problems in particle and nuclear physics","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-15T11:44:19.622453Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2604.01313"},"observation_digest":"sha256:143292abaf6218bbb8f2242d9da4268725d0f56eb24a225d00e06dad045a77de","observation_id":"7a95a448-434e-4b1e-8892-7db053c98616","resolution":{"observed_at":"2026-07-15T11:44:19.622453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2604.12426","last_updated":"2026-04-14T08:16:49Z","snapshot_observed_at":"2026-07-06T23:00:37.144068Z","submitted_at":"2026-04-14T08:16:49Z","title":"Do Transformers Use their Depth Adaptively? Evidence from a Relational Reasoning Task","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T15:34:02.796850Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2604.12426"},"observation_digest":"sha256:445c51853338459e79bfbc7557afd5db1977bcdf1042e207f05bd30894d76886","observation_id":"be5aafc9-b8d7-4015-a724-00a650b1d822","resolution":{"observed_at":"2026-05-11T10:16:07.435143Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2604.18124","last_updated":"2026-04-20T11:43:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-20T11:43:55Z","title":"TLoRA: Task-aware Low Rank Adaptation of Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-10T05:07:10.885133Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2604.18124"},"observation_digest":"sha256:119d6c62f6179b8deb31a06078a527c43f1b1d1f4369c98d72765e08d435f9f6","observation_id":"36c58128-dabc-4b40-8273-e70fefd77c63","resolution":{"observed_at":"2026-05-10T09:48:48.213921Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2604.20720","last_updated":"2026-04-22T16:07:10Z","snapshot_observed_at":"2026-07-06T23:07:25.185196Z","submitted_at":"2026-04-22T16:07:10Z","title":"COMPASS: COntinual Multilingual PEFT with Adaptive Semantic Sampling","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-10T01:14:16.831333Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2604.20720"},"observation_digest":"sha256:d87901eb198198d8b99a877a1dfdf51eb420bc6039dcafd52cf87c12698742f0","observation_id":"2fdd6eca-e619-4123-b2a9-e84a35e95e4b","resolution":{"observed_at":"2026-05-11T13:41:05.734202Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2605.06654","last_updated":"2026-05-07T17:57:02Z","snapshot_observed_at":"2026-07-06T23:19:05.764765Z","submitted_at":"2026-05-07T17:57:02Z","title":"Optimizer-Model Consistency: Full Finetuning with the Same Optimizer as Pretraining Forgets Less","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T12:00:49.127471Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2605.06654"},"observation_digest":"sha256:d08d9786df6083d7b486abc93c003dfb853e659ece7675f0bf74836e1651db68","observation_id":"ad4e9f03-6c4e-478a-826b-f9b537b6122c","resolution":{"observed_at":"2026-05-11T19:26:08.668232Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2605.07111","last_updated":"2026-05-18T05:08:10Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:38:58Z","title":"Beyond LoRA vs. Full Fine-Tuning: Gradient-Guided Optimizer Routing for LLM Adaptation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T01:10:16.768269Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2605.07111"},"observation_digest":"sha256:646052e8f201db868eaac7df8a2061a1e75416a22e0e59bdcc7aa957ff2bed1c","observation_id":"da2cd688-3801-437d-9cdb-b5e1de57ea5b","resolution":{"observed_at":"2026-05-11T04:40:58.748117Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2605.07111","last_updated":"2026-05-18T05:08:10Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:38:58Z","title":"Beyond LoRA vs. Full Fine-Tuning: Gradient-Guided Optimizer Routing for LLM Adaptation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T23:49:29.023187Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2605.07111"},"observation_digest":"sha256:cccd85572f0f02886be5c98334591c98d103403cb0a062f7255d067d6942136e","observation_id":"fc2c15e8-c169-4e05-b7a4-b68da4c4f0e2","resolution":{"observed_at":"2026-05-20T23:53:51.950419Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2605.09015","last_updated":"2026-05-09T15:54:11Z","snapshot_observed_at":"2026-07-06T23:21:11.475005Z","submitted_at":"2026-05-09T15:54:11Z","title":"LLiMba: Sardinian on a Single GPU -- Adapting a 3B Language Model to a Vanishing Romance Language","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T02:05:34.336556Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2605.09015"},"observation_digest":"sha256:56d753499f1c239b0ae1d384747c70a6f926541ef497a646baaea49db1ed8f59","observation_id":"7ef59fb9-071f-4c67-8cc9-088c31a35499","resolution":{"observed_at":"2026-05-12T02:06:14.854466Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2605.12492","last_updated":"2026-05-12T17:59:34Z","snapshot_observed_at":"2026-07-31T18:31:37.222688Z","submitted_at":"2026-05-12T17:59:34Z","title":"Pion: A Spectrum-Preserving Optimizer via Orthogonal Equivalence Transformation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T04:53:52.898843Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2605.12492"},"observation_digest":"sha256:045e6c38fcf9c0abcb9faf5bf0f356ed559e0818b34115ba8409caa29b93a870","observation_id":"93b51309-e1d9-4f0d-9828-7762c01b1dbf","resolution":{"observed_at":"2026-05-13T04:57:17.544947Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2605.12705","last_updated":"2026-05-12T20:08:00Z","snapshot_observed_at":"2026-08-06T21:05:32.361086Z","submitted_at":"2026-05-12T20:08:00Z","title":"Early Data Exposure Improves Robustness to Subsequent Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-14T20:45:27.673290Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2605.12705"},"observation_digest":"sha256:38f9f173586308c52e2e33d79d9af8ebf563f83df51e133a2df65feb35d0d321","observation_id":"b59f54f0-4355-493b-b234-53e0cc29cae8","resolution":{"observed_at":"2026-05-14T20:47:58.585687Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2605.20005","last_updated":"2026-05-19T15:36:52Z","snapshot_observed_at":"2026-07-06T23:30:39.512029Z","submitted_at":"2026-05-19T15:36:52Z","title":"Fine-Tuning Without Forgetting via Loss-Adaptive Learning Rates","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T07:14:59.396900Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2605.20005"},"observation_digest":"sha256:2976d1ff6d15dbf7b74296adfe2396df9140850c1d8f470f2c76cecc628c026a","observation_id":"7835c0b1-f3e1-46ed-8895-e63d5034b504","resolution":{"observed_at":"2026-05-20T07:18:06.993559Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2605.29498","last_updated":"2026-05-28T07:22:39Z","snapshot_observed_at":"2026-07-06T23:38:56.014434Z","submitted_at":"2026-05-28T07:22:39Z","title":"Mask the Target: A Plug-and-Play Regularizer Against LoRA Forgetting","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T07:36:24.624420Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2605.29498"},"observation_digest":"sha256:0802bcc6b77eab930caceda12a5a04caa308171771501d7e364dcd59c4507b99","observation_id":"0b607cfc-6ab4-4604-a1e4-1d3c2216c50d","resolution":{"observed_at":"2026-06-29T07:43:14.111340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2606.02437","last_updated":"2026-06-02T09:03:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-01T16:09:19Z","title":"On the Scaling of PEFT: Towards Million Personal Models of Trillion Parameters","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T15:32:19.456119Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2606.02437"},"observation_digest":"sha256:f0b3adb2e89fe4589d681b6714b183c87f6849f55f19f9bb8ab5031af801bd8a","observation_id":"7efc7797-6212-45b5-a20c-755e77444180","resolution":{"observed_at":"2026-07-01T22:16:16.708715Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2606.05559","last_updated":"2026-06-04T01:14:19Z","snapshot_observed_at":"2026-07-06T23:45:33.157370Z","submitted_at":"2026-06-04T01:14:19Z","title":"CLaaS: Continual learning as a service for sample efficient online learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-28T02:49:45.273824Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2606.05559"},"observation_digest":"sha256:61a92b0ad91356c80538b11632e712540f1c9c447854e028d557e96845b3e483","observation_id":"fc4ce5c8-0c82-4a96-b416-4b5120df26db","resolution":{"observed_at":"2026-07-02T11:46:56.254889Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":"2405.09673","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-04T19:30:07.259186Z","title":"Biderman, J","venue":null,"work_id":"ca00d37c-5297-4fa7-b692-52260eb614f2","year":2024},"citing_paper":{"arxiv_id":"2606.25342","last_updated":"2026-06-24T03:14:20Z","snapshot_observed_at":"2026-07-06T23:59:47.542695Z","submitted_at":"2026-06-24T03:14:20Z","title":"Lifelong In-Context Learning with Transformers Requires Parametric Forms of Attention","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-25T21:19:30.138022Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2606.25342"},"observation_digest":"sha256:aeba1011000d2475fca67c20c18709a9f009dc3b239ebd5e7121a618ef513e14","observation_id":"7c13fb18-ae91-44ae-9e0b-aff4f1a1e6c4","resolution":{"observed_at":"2026-07-04T19:30:07.260600Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-07-11T18:20:40.287006Z","title":"Cunningham","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04510","last_updated":"2026-08-03T19:51:37Z","snapshot_observed_at":"2026-08-08T04:50:59.486787Z","submitted_at":"2026-07-05T21:23:15Z","title":"Transplanting, inverting, and preventing a misalignment persona: method-conditional emergent misalignment in Qwen2.5","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-11T18:20:40.287006Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2607.04510"},"observation_digest":"sha256:f940947ef76a171a4ae6871c50f228ce44099432d0dd7141619bb286324eb433","observation_id":"cb291aa2-d2a7-42aa-b6e8-a7138491347c","resolution":{"observed_at":"2026-07-11T18:20:40.287006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-02T15:39:35.740336Z","title":"Lora learns less and forgets less.arXiv:2405.09673,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11889","last_updated":"2026-07-17T09:32:58Z","snapshot_observed_at":"2026-08-08T09:40:05.908022Z","submitted_at":"2026-04-24T17:00:53Z","title":"Scaling Point-in-Time Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T15:39:35.740336Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2607.11889"},"observation_digest":"sha256:7fa2cf4e948d8df3988af123f1a1b1cd1f12e1ccddb0998b4ebfa13930f2a0bd","observation_id":"3f3a08d2-b253-441f-ba5d-719e68bbfe60","resolution":{"observed_at":"2026-08-02T15:39:35.740336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-02T09:51:03.796812Z","title":"arXiv preprint arXiv:2405.09673 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16252","last_updated":"2026-06-27T03:25:36Z","snapshot_observed_at":"2026-08-08T02:31:05.095460Z","submitted_at":"2026-06-27T03:25:36Z","title":"SOS-LoRA: Static Orthogonal-Subspace Low-Rank Adaptation with Fixed Multi-Scale Scaling","version":1},"reference_index":226,"source":"arxiv_source","source_observed_at":"2026-08-02T09:51:03.796812Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2607.16252"},"observation_digest":"sha256:03c3e29333c9acfd63e37bc526e59680034caf9dfb2e6d7bf17ea2ef1eb1ba52","observation_id":"647d14f5-f301-46b9-8dfb-988e024739e0","resolution":{"observed_at":"2026-08-02T09:51:03.796812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-01T17:51:35.656758Z","title":"Transactions on Machine Learning Research (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17513","last_updated":"2026-07-20T03:38:17Z","snapshot_observed_at":"2026-08-08T16:44:08.194576Z","submitted_at":"2026-07-20T03:38:17Z","title":"After the Euclidean Highway: Hyperbolic Expert AI as the Next Innovation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T17:51:35.656758Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2607.17513"},"observation_digest":"sha256:5ee047e58829b0a6173827b4b3bc8bc4765d022a13cfca328471d0a71d77cae2","observation_id":"50706905-1a48-42f7-ae20-95ed938f40e7","resolution":{"observed_at":"2026-08-01T17:51:35.656758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-01T17:32:31.846788Z","title":"LoRA Learns Less and Forgets Less","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17620","last_updated":"2026-07-20T07:16:31Z","snapshot_observed_at":"2026-08-06T10:27:53.292028Z","submitted_at":"2026-07-20T07:16:31Z","title":"PoLoRA: A Preconditioned Orthogonalized LoRA Optimizer","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T17:32:31.846788Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2607.17620"},"observation_digest":"sha256:43de51a9772c35608c8c7f50c78e0817b42a7d110dbbdfa00655d89961ebe22f","observation_id":"133b63de-da01-4647-8be8-557e898c60b3","resolution":{"observed_at":"2026-08-01T17:32:31.846788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-02T09:22:00.516068Z","title":"arXiv preprint arXiv:2405.09673 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18293","last_updated":"2026-06-30T19:56:05Z","snapshot_observed_at":"2026-08-06T17:14:01.465535Z","submitted_at":"2026-06-30T19:56:05Z","title":"One Student, Many Teachers: Multi-Task On-Policy Distillation via Soft-Prompt Privileged Context","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T09:22:00.516068Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2607.18293"},"observation_digest":"sha256:aca4ceeb675e4b400d6b3d2a594b0e2b7b84b2bbc5093ff81461fb3229576fc4","observation_id":"fdec435e-912a-441e-a1e1-44583e708703","resolution":{"observed_at":"2026-08-02T09:22:00.516068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-01T06:18:16.224560Z","title":"arXiv preprint arXiv:2405.09673 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21978","last_updated":"2026-07-24T04:50:39Z","snapshot_observed_at":"2026-08-07T20:59:48.143638Z","submitted_at":"2026-07-24T04:50:39Z","title":"MoE$^2$-LoRA: When MoE Models Meet MoE-style Low-Rank Adaptation","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-01T06:18:16.224560Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2607.21978"},"observation_digest":"sha256:66e6a883d77de2bbbbc7890b01f8177e0302afc7f5445259177f11888154fba4","observation_id":"51594cad-bd49-468d-86d1-976d8db05fd8","resolution":{"observed_at":"2026-08-01T06:18:16.224560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-01T06:08:25.705441Z","title":"Lora learns less and forgets less,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22010","last_updated":"2026-07-24T06:15:39Z","snapshot_observed_at":"2026-08-04T11:43:46.786247Z","submitted_at":"2026-07-24T06:15:39Z","title":"How Meta-Learning Shapes LoRA Adapter Geometry in Speech Deepfake Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T06:08:25.705441Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2607.22010"},"observation_digest":"sha256:03a8955593c6d2e9f13413f40ca5067fb2d525dac12013cf37db4351780973cb","observation_id":"8e4cae20-cd6b-4b34-92ad-aa2b500648b6","resolution":{"observed_at":"2026-08-01T06:08:25.705441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09673","snapshot_observed_at":"2026-08-01T01:59:49.777615Z","title":"Lora learns less and forgets less.arXiv preprint arXiv:2405.09673,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25614","last_updated":"2026-07-28T11:45:34Z","snapshot_observed_at":"2026-08-06T22:14:48.621295Z","submitted_at":"2026-07-28T11:45:34Z","title":"MemSFT: Mitigating Alignment Tax with an External Parametric Memory","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T01:59:49.777615Z"},"links":{"cited_paper":"/paper/2405.09673","citing_paper":"/paper/2607.25614"},"observation_digest":"sha256:d901fed13d34c067fa0f7e77ea2a0694813d80160aa870718800ee70769cdea6","observation_id":"ef603cd2-3f3e-472d-9311-0db57add52cf","resolution":{"observed_at":"2026-08-01T01:59:49.777615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2405.09673/citation-record","integrity":"/paper/2405.09673/integrity","json":"/paper/2405.09673/citation-record.json","paper":"/paper/2405.09673"},"outbound":[],"paper":{"arxiv_id":"2405.09673","last_updated":"2024-09-20T21:21:56Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-04T07:20:49.662052Z","submitted_at":"2024-05-15T19:27:45Z","title":"LoRA Learns Less and Forgets Less"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 45 inbound Pith citation observations for arXiv:2405.09673."}