{"as_of":"2026-08-17T21:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:60b5603aa89598b03db2895bbcf20e92dff3527a5730adb90dbc495bd1aa8b5b","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:09:16.082796Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T09:01:46.458539Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T18:51:07.429970Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"cited_work":{"arxiv_id":"2506.00495","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00495","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Floe: Fisher-based layer selection for efficient sparse adaptation of low-rank experts","venue":null,"work_id":"b326173b-5a35-4b60-ab02-d122997a90e7","year":2025},"citing_paper":{"arxiv_id":"2605.06166","last_updated":"2026-05-07T12:52:02Z","snapshot_observed_at":"2026-08-16T06:49:16.391802Z","submitted_at":"2026-05-07T12:52:02Z","title":"One Algorithm, Two Goals: Dual Scoring for Parameter and Data Selection in LLM Fine-Tuning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-08T13:40:50.908566Z"},"links":{"cited_paper":"/paper/2506.00495","citing_paper":"/paper/2605.06166"},"observation_digest":"sha256:97d25b08bd1efbcf8d9b7f5d839ae63c074722cd799abaade5682a6bbeec82a4","observation_id":"cf0213bb-963b-4605-99a1-ce6dd3a2fdce","resolution":{"observed_at":"2026-05-11T18:51:07.433669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00495","snapshot_observed_at":"2026-08-02T09:01:46.458539Z","title":"arXiv preprint arXiv:2506.00495 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19391","last_updated":"2026-07-02T19:01:59Z","snapshot_observed_at":"2026-08-14T00:07:02.064739Z","submitted_at":"2026-07-02T19:01:59Z","title":"LAARA: Layer-Aware Adaptive Rank Allocation for Parameter-Efficient Fine-Tuning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T09:01:46.458539Z"},"links":{"cited_paper":"/paper/2506.00495","citing_paper":"/paper/2607.19391"},"observation_digest":"sha256:401839d723bf9f7e57dc4056f0453055132c9210bed85e7e5bfa0e23791cefd9","observation_id":"5d6a5c94-e727-46c0-9243-badeb91d54df","resolution":{"observed_at":"2026-08-02T09:01:46.458539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00495/citation-record","integrity":"/paper/2506.00495/integrity","json":"/paper/2506.00495/citation-record.json","paper":"/paper/2506.00495"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:20.493158Z","title":"Optuna: A next- generation hyperparameter optimization framework","venue":null,"work_id":"66caef55-4968-4eab-ba2b-768c06fd2a7b","year":2019},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:11.634049Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:3b1d26a47f1082eb0b6675dd2b8182257f3909b55baad1c74dcc3a5b0228081a","observation_id":"7683bbbb-542d-4a21-99f3-248b5425294d","resolution":{"observed_at":"2026-08-07T12:09:20.579934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:20.320689Z","title":"Lawyer-instruct, 2024","venue":null,"work_id":"5f6279a1-e188-491d-a756-3de93f7a438e","year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:11.693806Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:f58c313103348fe4c63901d77c6b775683240ce83b16894c46050b35dac24eb2","observation_id":"0ad25361-6050-4fc0-9571-b5c1b08b8c91","resolution":{"observed_at":"2026-08-07T12:09:20.398749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07507","last_updated":"2023-05-22T18:20:54Z","snapshot_observed_at":"2026-08-17T05:28:47.810802Z","submitted_at":"2023-05-12T14:21:38Z","title":"LeXFiles and LegalLAMA: Facilitating English Multinational Legal Language Model Development","version":2},"cited_work":{"arxiv_id":"2305.07507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.07507","snapshot_observed_at":"2026-08-07T12:09:17.736596Z","title":"LeXFiles and LegalLAMA: Facilitating English Multinational Legal Language Model Development","venue":"cs.CL","work_id":"e0f3c1a5-0477-447a-9ceb-93d74aacb57d","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:11.782813Z"},"links":{"cited_paper":"/paper/2305.07507","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:fdcb9945fb965297585be197be816da125d6b8d6b04b83a22eff307bb19468d2","observation_id":"1ef382ed-9a9a-40cb-b28a-92d33167cddd","resolution":{"observed_at":"2026-08-07T12:09:17.823694Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:20.107375Z","title":"Code alpaca: An instruction-following llama model for code generation","venue":null,"work_id":"68822eb1-f400-4d8e-bd8d-365d6a301b00","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:11.847185Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:6e36fd55761bdd779b4e05884082be37c89bf4212c1f18e1dfd9e08606ff4485","observation_id":"c6c3ea2a-3dc2-47b0-84d3-79e2ede3326e","resolution":{"observed_at":"2026-08-07T12:09:20.209464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T12:09:11.903523Z","title":"Evaluating large language models trained on code","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:11.903523Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:3d18bb51c708179049648b855421167ed5afe55b4813e165798af19878b13ac5","observation_id":"b66aaec8-d160-43ba-bfb3-e2c5a3e8e6e6","resolution":{"observed_at":"2026-08-07T12:09:11.903523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12307","last_updated":"2024-03-08T15:26:38Z","snapshot_observed_at":"2026-08-16T14:58:40.364858Z","submitted_at":"2023-09-21T17:59:11Z","title":"LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12307","snapshot_observed_at":"2026-08-07T12:09:12.021487Z","title":"Longlora: Efficient fine-tuning of long-context large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.021487Z"},"links":{"cited_paper":"/paper/2309.12307","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:a7e4b21d8145d011a9198e6689c003c2fbe5e54fc6790fb4926c4897acee4c45","observation_id":"2d0ef40b-9c6f-4ca2-9015-ee2215dd5902","resolution":{"observed_at":"2026-08-07T12:09:12.021487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T12:09:12.137416Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.137416Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:5dcebc4af20d301c24667889bf9b41d8f6dde516c3f70ab69337509ad4991e5b","observation_id":"c09ad824-72cd-46f1-aca0-212920c393dc","resolution":{"observed_at":"2026-08-07T12:09:12.137416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11696","last_updated":"2023-11-20T11:56:25Z","snapshot_observed_at":"2026-08-16T14:41:53.322833Z","submitted_at":"2023-11-20T11:56:25Z","title":"Sparse Low-rank Adaptation of Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11696","snapshot_observed_at":"2026-08-07T12:09:12.204135Z","title":"Sparse low-rank adaptation of pre-trained language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.204135Z"},"links":{"cited_paper":"/paper/2311.11696","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:596dc691e8510b8616441aa31e885186943226486b97497b14106c2f94a7077e","observation_id":"ea3c9c56-9ebb-4ecf-9443-872ff52aae0f","resolution":{"observed_at":"2026-08-07T12:09:12.204135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09979","last_updated":"2024-03-08T13:13:54Z","snapshot_observed_at":"2026-08-17T15:38:47.999453Z","submitted_at":"2023-12-15T17:45:06Z","title":"LoRAMoE: Alleviate World Knowledge Forgetting in Large Language Models via MoE-Style Plugin","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09979","snapshot_observed_at":"2026-08-07T12:09:12.260399Z","title":"Loramoe: Alleviate world knowledge forgetting in large language models via moe-style plugin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.260399Z"},"links":{"cited_paper":"/paper/2312.09979","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:ece8c4a68cea76cd797e4b1bd616c261b551cba4c9ee4f88e120d1e2f48f1e78","observation_id":"82c30370-8b25-41b2-81ec-59f267d1155f","resolution":{"observed_at":"2026-08-07T12:09:12.260399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16710","last_updated":"2024-10-18T04:02:31Z","snapshot_observed_at":"2026-08-16T13:57:49.916883Z","submitted_at":"2024-04-25T16:20:23Z","title":"LayerSkip: Enabling Early Exit Inference and Self-Speculative Decoding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16710","snapshot_observed_at":"2026-08-07T12:09:12.308512Z","title":"Layer skip: Enabling early exit inference and self-speculative decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.308512Z"},"links":{"cited_paper":"/paper/2404.16710","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:54e34feb33ac068a40a5ab8ab34b9cb6f25301308d56b2bd86c7004e5f5849ec","observation_id":"0113ec4d-12cc-47a3-a9ee-8541f257414a","resolution":{"observed_at":"2026-08-07T12:09:12.308512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:19.891037Z","title":"Sparsegpt: Massive language models can be accurately pruned in one-shot","venue":null,"work_id":"de62d5fd-9653-4d0e-a858-8e019b756893","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.426724Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:a9d8c64e288df530c78c24f2ba3227cbdb64f10e1fde9a73b857830df4f22b07","observation_id":"13e82321-11c0-4552-aca1-724394c2d4d1","resolution":{"observed_at":"2026-08-07T12:09:19.998930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:19.673368Z","title":"MoLA: MoE LoRA with layer-wise expert allocation","venue":null,"work_id":"636c9e06-e516-4c72-8835-49edc3e6f4b2","year":2025},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.548266Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:fbcceb796ae1d3fd9d28233e94ffada526c328add3262aab0eb42a3e12392e62","observation_id":"99355fc6-1aec-49fa-933d-c834be2ef5b3","resolution":{"observed_at":"2026-08-07T12:09:19.761730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12354","last_updated":"2024-07-04T18:33:00Z","snapshot_observed_at":"2026-08-16T14:17:14.074196Z","submitted_at":"2024-02-19T18:33:49Z","title":"LoRA+: Efficient Low Rank Adaptation of Large Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12354","snapshot_observed_at":"2026-08-07T12:09:12.683982Z","title":"Lora+: Efficient low rank adaptation of large models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.683982Z"},"links":{"cited_paper":"/paper/2402.12354","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:53eff42406cc9db2a1f20d91efa489467bc82a2f7baa6b789729e4ac2ae6e065","observation_id":"a7539167-998f-4850-97f6-2d71c6791861","resolution":{"observed_at":"2026-08-07T12:09:12.683982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T12:09:12.747324Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.747324Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:1df7742d04e073937f883fe3532bae9306f575964f2f36d658cb5d5971a01d85","observation_id":"35191f7c-ee29-4acb-b4d7-5ac735ccebf7","resolution":{"observed_at":"2026-08-07T12:09:12.747324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-17T18:04:53.578114Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T12:09:12.828043Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.828043Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:f30ab30a0a2e7d5e39f00b7fe0edb4f90eb0f126d0f2cbb2c8cb71713ab8d58e","observation_id":"65d3186f-8a03-4440-a8e6-a798f8ac1388","resolution":{"observed_at":"2026-08-07T12:09:12.828043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13269","last_updated":"2024-08-19T03:31:19Z","snapshot_observed_at":"2026-08-16T15:13:34.132588Z","submitted_at":"2023-07-25T05:39:21Z","title":"LoraHub: Efficient Cross-Task Generalization via Dynamic LoRA Composition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13269","snapshot_observed_at":"2026-08-07T12:09:12.947347Z","title":"Lorahub: Efficient cross-task generalization via dynamic lora composition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:12.947347Z"},"links":{"cited_paper":"/paper/2307.13269","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:9d34398ea1c450a68c53c83cdde56471af1e88af57d5d8064a12abfdc6d6bb4d","observation_id":"59efa1c4-7256-4603-85e4-1dddbf36c5c0","resolution":{"observed_at":"2026-08-07T12:09:12.947347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:13.039183Z","title":"Adaptive mixtures of local experts","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.039183Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:a50c91cf9166372db8d3b2d336ce335c624e2a96ebc009412ce988e559b9338d","observation_id":"6ff322d2-0b8e-4641-885d-63f033c2b1e1","resolution":{"observed_at":"2026-08-07T12:09:13.039183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:19.497778Z","title":"Identifying and mitigating vulnerabilities in llm-integrated applications","venue":null,"work_id":"4fdfbe71-6462-4b35-9f5e-c7ad4213658b","year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.137198Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:2ed0f29ef557eb4b5d65c6a73f0b93d278c6530afd4e233cd5e8a212e087c88c","observation_id":"8d115b63-0b99-4016-91a5-b56091d284de","resolution":{"observed_at":"2026-08-07T12:09:19.538346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12130","last_updated":"2024-05-20T15:48:32Z","snapshot_observed_at":"2026-08-16T13:51:16.220394Z","submitted_at":"2024-05-20T15:48:32Z","title":"MoRA: High-Rank Updating for Parameter-Efficient Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12130","snapshot_observed_at":"2026-08-07T12:09:13.194756Z","title":"Mora: High-rank updating for parameter-efficient fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.194756Z"},"links":{"cited_paper":"/paper/2405.12130","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:f57bdafc46afa3dbf611e1f0c69a9049d7a9282aa1f722918c37fc22b198f297","observation_id":"15d9fede-8697-47c9-b17f-cd54e020620f","resolution":{"observed_at":"2026-08-07T12:09:13.194756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06354","last_updated":"2023-07-02T12:28:46Z","snapshot_observed_at":"2026-08-16T15:55:45.565145Z","submitted_at":"2023-02-13T13:38:46Z","title":"Less is More: Selective Layer Finetuning with SubTuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06354","snapshot_observed_at":"2026-08-07T12:09:13.253965Z","title":"Less is more: Selective layer finetuning with subtuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.253965Z"},"links":{"cited_paper":"/paper/2302.06354","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:0aa20c992ba6a2af0413e03f0339ceb93329e2b694a44a6ff373045940dcfc52","observation_id":"7073d266-c72e-4a0b-999c-6545f0ca91c1","resolution":{"observed_at":"2026-08-07T12:09:13.253965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11454","last_updated":"2024-01-16T18:59:22Z","snapshot_observed_at":"2026-08-16T14:51:17.392681Z","submitted_at":"2023-10-17T17:59:46Z","title":"VeRA: Vector-based Random Matrix Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11454","snapshot_observed_at":"2026-08-07T12:09:13.327298Z","title":"Vera: Vector-based random matrix adaptation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.327298Z"},"links":{"cited_paper":"/paper/2310.11454","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:818bce5cbe5ff4ae737da8d6e8720e4b8902e372ac0e28ad35225021b4034573","observation_id":"476400f6-a7f8-4adc-94f1-13ad6cadf667","resolution":{"observed_at":"2026-08-07T12:09:13.327298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:13.415948Z","title":"Optimal brain damage","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.415948Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:638816d994a6b0099bc72ceb08943f1508bc8ba1b63b12248959876614f57481","observation_id":"e4011ca0-94cc-44f0-af08-36b777fe1ee2","resolution":{"observed_at":"2026-08-07T12:09:13.415948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11466","last_updated":"2023-06-06T05:58:11Z","snapshot_observed_at":"2026-08-16T16:22:27.724490Z","submitted_at":"2022-10-20T17:59:15Z","title":"Surgical Fine-Tuning Improves Adaptation to Distribution Shifts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11466","snapshot_observed_at":"2026-08-07T12:09:13.508685Z","title":"Surgical fine-tuning improves adaptation to distribution shifts","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.508685Z"},"links":{"cited_paper":"/paper/2210.11466","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:6a82ac6e54895921397248b0f2c576e3728e6cfb88122bc8dec6bc47c90dc6db","observation_id":"7424c8fc-b454-4235-843c-f4c8b92703db","resolution":{"observed_at":"2026-08-07T12:09:13.508685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:19.295348Z","title":"Conditional adapters: Parameter-efficient transfer learning with fast inference","venue":null,"work_id":"7bfe3a2b-a048-4e3c-ae46-df7c60e6e4ba","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.599639Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:94c10e7744db82f141215fb7ce83c7d3704dae7f5bbf5ae840674b1709ebcde2","observation_id":"267a91a9-8fc1-4630-b922-1050960b6381","resolution":{"observed_at":"2026-08-07T12:09:19.390243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-16T20:01:36.160048Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-08-07T12:09:13.680914Z","title":"The power of scale for parameter-efficient prompt tuning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.680914Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:e615d266928a91242d112f467846f457486f8196b717fd221fb70bdd13daba63","observation_id":"8ac650bd-c276-4e7d-bf25-c907bf2df1a4","resolution":{"observed_at":"2026-08-07T12:09:13.680914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00190","last_updated":"2021-01-01T08:00:36Z","snapshot_observed_at":"2026-08-12T12:37:28.207761Z","submitted_at":"2021-01-01T08:00:36Z","title":"Prefix-Tuning: Optimizing Continuous Prompts for Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00190","snapshot_observed_at":"2026-08-07T12:09:13.790010Z","title":"Prefix-tuning: Optimizing continuous prompts for generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.790010Z"},"links":{"cited_paper":"/paper/2101.00190","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:c4c2b1cafdf484e06b0ece17dbf0947c64f447c9a121e92cd3d24c0cedb03244","observation_id":"e75d4cba-4d09-4444-882b-d743e9294843","resolution":{"observed_at":"2026-08-07T12:09:13.790010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:13.856626Z","title":"Chatdoctor: A medical chat model fine-tuned on a large language model meta-ai (llama) using medical domain knowledge","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.856626Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:262221b884e2bbbd502d11f50a82e236219e06b0e66d59d068b8d1d8aff83a6e","observation_id":"f50f1ee1-0d78-4e8a-98ff-fce668dbe521","resolution":{"observed_at":"2026-08-07T12:09:13.856626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:13.966715Z","title":"Few-shot parameter-efficient fine-tuning is better and cheaper than in-context learning","venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:13.966715Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:48ce33f40967bc6dd96f2cb63b2a738cae66948cb87a5583a7dd1ebeda265bb2","observation_id":"463410fe-f299-4cda-b946-f65651bcc183","resolution":{"observed_at":"2026-08-07T12:09:13.966715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09353","last_updated":"2024-07-09T05:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-14T17:59:34Z","title":"DoRA: Weight-Decomposed Low-Rank Adaptation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09353","snapshot_observed_at":"2026-08-07T12:09:14.018675Z","title":"Dora: Weight-decomposed low-rank adaptation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.018675Z"},"links":{"cited_paper":"/paper/2402.09353","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:b77a167fca02e43a7927ef1023bff9f6abe0343610557749db297b2f9f0b0e8f","observation_id":"7720f447-ffda-46b3-8793-79ddcecee064","resolution":{"observed_at":"2026-08-07T12:09:14.018675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07602","last_updated":"2022-03-20T15:13:08Z","snapshot_observed_at":"2026-08-16T17:49:14.370097Z","submitted_at":"2021-10-14T17:58:47Z","title":"P-Tuning v2: Prompt Tuning Can Be Comparable to Fine-tuning Universally Across Scales and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07602","snapshot_observed_at":"2026-08-07T12:09:14.108874Z","title":"P-tuning v2: Prompt tuning can be comparable to fine-tuning universally across scales and tasks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.108874Z"},"links":{"cited_paper":"/paper/2110.07602","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:0cc747dd1594af7cb2a5c2fc2d95d33f0987a31a7f2136b123a81ce2522659db","observation_id":"63c044d9-1594-43df-a25e-72eaea3b12f8","resolution":{"observed_at":"2026-08-07T12:09:14.108874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:14.194630Z","title":"Gpt understands, too","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.194630Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:ca55dcaf55da42fc9d21f7e529f825da9db8f764607a739e4e62c830754336b1","observation_id":"bc2d7b63-5914-4398-b325-88cd06979c10","resolution":{"observed_at":"2026-08-07T12:09:14.194630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16187","last_updated":"2024-04-15T13:25:05Z","snapshot_observed_at":"2026-08-16T14:06:56.830686Z","submitted_at":"2024-03-24T15:09:55Z","title":"ALoRA: Allocating Low-Rank Adaptation for Fine-tuning Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16187","snapshot_observed_at":"2026-08-07T12:09:14.299953Z","title":"Alora: Allocating low-rank adaptation for fine-tuning large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.299953Z"},"links":{"cited_paper":"/paper/2403.16187","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:48a1543932d80569d8a2119b75bd15d7519725b5c5786806dc09397be5e4ddcb","observation_id":"eebf33fb-65d8-42ba-a3b5-b570debd78e9","resolution":{"observed_at":"2026-08-07T12:09:14.299953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:18.992445Z","title":"The flan collection: Designing data and methods for effective instruction tuning","venue":null,"work_id":"1564b0a2-78bb-43ff-83ce-eeee295d6bef","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.426059Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:b08bd533ed4f63146823898aeecfc4f55cd4017514d401445a75bef4b3c3c345","observation_id":"9cb5dd07-0a0e-4f7c-b738-0b78eb777066","resolution":{"observed_at":"2026-08-07T12:09:19.120563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:18.816999Z","title":"Llm-pruner: On the structural pruning of large language models","venue":null,"work_id":"508ffa67-0c63-4165-a3ae-a7b8826479fe","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.492378Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:784f01cae37e7ae78dde5d5c51b4a772424df518f9a08cdaa958bbc4aee2f356","observation_id":"6bce41b6-6fd3-42ea-b72f-9ccd78d319ae","resolution":{"observed_at":"2026-08-07T12:09:18.911647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02948","last_updated":"2025-04-09T06:54:20Z","snapshot_observed_at":"2026-08-16T14:03:55.518349Z","submitted_at":"2024-04-03T15:06:43Z","title":"PiSSA: Principal Singular Values and Singular Vectors Adaptation of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02948","snapshot_observed_at":"2026-08-07T12:09:14.600815Z","title":"Pissa: principal singular values and singular vectors adaptation of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.600815Z"},"links":{"cited_paper":"/paper/2404.02948","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:9945f0be72fdc212da99551dfadd716ed1cacc3f2212d2af48b26eccd368756c","observation_id":"d99fac71-411c-43cb-ab37-0d7cb3741954","resolution":{"observed_at":"2026-08-07T12:09:14.600815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:18.620287Z","title":"Free dolly: Introducing the world’s first truly open instruction-tuned llm, 2023","venue":null,"work_id":"73b0a2da-a917-43db-8bb4-8e709fe32b50","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.697383Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:03c4799886fc3f1ec54704893738a67fee4abe1d1e624ed107b428ed1e436ccf","observation_id":"7b01ed15-55f5-4760-930e-2c6724856a38","resolution":{"observed_at":"2026-08-07T12:09:18.721469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:18.439710Z","title":"Multi-head adapter routing for cross-task generalization","venue":null,"work_id":"496da4a1-7a59-4c5e-9ce0-2dd66f7eff78","year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.739016Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:95c8fbcfdb81bfa1a8517621b8151e569e725083ee6b55d37fd5d0cfce7a5095","observation_id":"9b2ca90e-7073-4e19-bd7d-a2da2c2c71a6","resolution":{"observed_at":"2026-08-07T12:09:18.521590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17919","last_updated":"2024-12-25T19:03:23Z","snapshot_observed_at":"2026-08-16T14:06:09.445883Z","submitted_at":"2024-03-26T17:55:02Z","title":"LISA: Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17919","snapshot_observed_at":"2026-08-07T12:09:14.828645Z","title":"Lisa: Lay- erwise importance sampling for memory-efficient large language model fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.828645Z"},"links":{"cited_paper":"/paper/2403.17919","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:8c1a3f8ab2b32299820afadc16780a85026928df208f7fd8fe6ef076199c40ab","observation_id":"4582706e-1f12-4388-9402-9a06cb53819c","resolution":{"observed_at":"2026-08-07T12:09:14.828645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09578","last_updated":"2024-04-12T23:15:51Z","snapshot_observed_at":"2026-08-16T14:42:49.349641Z","submitted_at":"2023-11-16T05:29:39Z","title":"Tied-Lora: Enhancing parameter efficiency of LoRA with weight tying","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09578","snapshot_observed_at":"2026-08-07T12:09:14.911036Z","title":"Tied-lora: Enhacing parameter efficiency of lora with weight tying","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.911036Z"},"links":{"cited_paper":"/paper/2311.09578","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:5ad968a32619db55f4b39fcf427b956ffc7dd5ffe433b63880423771388dea91","observation_id":"4f3e6791-b887-4ff9-9fb4-2a6882427481","resolution":{"observed_at":"2026-08-07T12:09:14.911036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:18.291225Z","title":"On the effect of dropping layers of pre-trained transformer models","venue":null,"work_id":"2fad24e2-22f1-4749-a4f0-e71d6ae5c931","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:14.988464Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:93eb2ae2cb3506044d91bcadf79cb3b2213505c60ab9f362a017de72bb09ff1a","observation_id":"74c9f7c5-94c6-444c-bb2b-412accc9cf35","resolution":{"observed_at":"2026-08-07T12:09:18.356371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-08-13T11:35:07.866136Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-07T12:09:15.073697Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.073697Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:0fc4c6258aa72e87cf672c9ec96c577532a9a1b3413ffeed095f312abdba642a","observation_id":"e8c1a75d-c3e5-43c2-8d75-b59da1c84211","resolution":{"observed_at":"2026-08-07T12:09:15.073697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-07T12:09:15.147892Z","title":"Challenging big-bench tasks and whether chain-of-thought can solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.147892Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:17ed7c0c33c4299a3e1f718eb5805ffa510b8ae3404658a130da107b38b0d342","observation_id":"538c6522-9b89-4391-8dac-dcca1108c594","resolution":{"observed_at":"2026-08-07T12:09:15.147892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T12:09:15.248008Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.248008Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:029c782bf1fdc093a0cc454caeed869ba26777f13811b8bbfefd54dc58627aa2","observation_id":"6ad5e942-e6d5-46a9-a548-b12eff57d5fa","resolution":{"observed_at":"2026-08-07T12:09:15.248008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19245","last_updated":"2024-05-23T15:06:02Z","snapshot_observed_at":"2026-08-16T13:56:44.962302Z","submitted_at":"2024-04-30T04:01:09Z","title":"HydraLoRA: An Asymmetric LoRA Architecture for Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19245","snapshot_observed_at":"2026-08-07T12:09:15.315090Z","title":"Hydralora: An asymmetric lora architecture for efficient fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.315090Z"},"links":{"cited_paper":"/paper/2404.19245","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:17dcd71be77b350f41d7f7cb47cda6880d70e2828989b8643207579507f5b219","observation_id":"482b0006-63b8-4908-af19-71a8acc16119","resolution":{"observed_at":"2026-08-07T12:09:15.315090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T12:09:15.426608Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.426608Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:729191a5da76f3416c29b3845916d0c72f127b2ffc1b79e672b5bad50afe0cea","observation_id":"61b5f1ca-7afa-479a-87cf-bedd8617bc80","resolution":{"observed_at":"2026-08-07T12:09:15.426608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07558","last_updated":"2023-04-19T04:28:24Z","snapshot_observed_at":"2026-08-17T17:51:14.764253Z","submitted_at":"2022-10-14T06:29:22Z","title":"DyLoRA: Parameter Efficient Tuning of Pre-trained Models using Dynamic Search-Free Low-Rank Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07558","snapshot_observed_at":"2026-08-07T12:09:15.530983Z","title":"Dylora: Parameter efficient tun- ing of pre-trained models using dynamic search-free low-rank adaptation.arXiv preprint arXiv:2210.07558, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.530983Z"},"links":{"cited_paper":"/paper/2210.07558","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:91491789b5bbbfffd7462c46df22237fad04af93aad461236a06a8a26d488f60","observation_id":"d672f9e3-34e0-439c-90d1-0522e1fd63e4","resolution":{"observed_at":"2026-08-07T12:09:15.530983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:18.155205Z","title":"Eigendamage: Structured pruning in the kronecker-factored eigenbasis","venue":null,"work_id":"7685f599-6dd2-44d8-999b-912453e18d1c","year":2019},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.640336Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:edcd9cdc542adfe19765f3b348dfd0f2324201ba1ec0afb1718a69545b6a6287","observation_id":"7de5f910-32d8-4ab3-8de0-cd873ccf9534","resolution":{"observed_at":"2026-08-07T12:09:18.206008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12410","last_updated":"2022-11-02T02:47:17Z","snapshot_observed_at":"2026-08-16T16:57:54.620909Z","submitted_at":"2022-05-24T23:41:22Z","title":"AdaMix: Mixture-of-Adaptations for Parameter-efficient Model Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12410","snapshot_observed_at":"2026-08-07T12:09:15.732927Z","title":"Adamix: Mixture-of-adapter for parameter-efficient tuning of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.732927Z"},"links":{"cited_paper":"/paper/2205.12410","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:d92aeb44c1f78481c3c07e7d05ede68e25c81d259d489040cc43307f9c0a16c6","observation_id":"dab70a53-010a-4440-aa7a-6607e60ae327","resolution":{"observed_at":"2026-08-07T12:09:15.732927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:09:17.934408Z","title":"Zhao, Kelvin Guu, Adams Wei Yu, Brian Lester, Nan Du, Andrew M","venue":null,"work_id":"d3af7813-f126-438a-942e-19d0333f34ea","year":2022},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.809137Z"},"links":{"citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:0620d975b3c3df6f47767e0519d1ec59a09f6f3470a10ab77a98a1e57bbcfa70","observation_id":"f43b12e6-3060-43a9-ad56-6a47d15013d5","resolution":{"observed_at":"2026-08-07T12:09:18.033356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15477","last_updated":"2023-10-24T03:08:58Z","snapshot_observed_at":"2026-08-16T14:49:30.924197Z","submitted_at":"2023-10-24T03:08:58Z","title":"CRaSh: Clustering, Removing, and Sharing Enhance Fine-tuning without Full Large Language Model","version":1},"cited_work":{"arxiv_id":"2310.15477","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.15477","snapshot_observed_at":"2026-08-07T12:09:16.342202Z","title":"CRaSh: Clustering, Removing, and Sharing Enhance Fine-tuning without Full Large Language Model","venue":"cs.CL","work_id":"55582a46-1e81-485c-a4f3-d96c63389056","year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.900942Z"},"links":{"cited_paper":"/paper/2310.15477","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:d96e3b9cddd91d6416c73635f54762a1258b4d5db7a8fd8f4a08ace071589a82","observation_id":"b202b104-fc60-40bd-ac11-596a10c6a66a","resolution":{"observed_at":"2026-08-07T12:09:16.407359Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03303","last_updated":"2026-05-09T05:30:15Z","snapshot_observed_at":"2026-08-13T08:01:16.750424Z","submitted_at":"2023-08-07T05:12:27Z","title":"LoRA-FA: Efficient and Effective Low Rank Representation Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03303","snapshot_observed_at":"2026-08-07T12:09:15.974806Z","title":"Lora-fa: Memory-efficient low-rank adaptation for large language models fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:15.974806Z"},"links":{"cited_paper":"/paper/2308.03303","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:2cf3e65e684c18129fef5d15692ba03f71c3af03ccc9c8f90edcb86616b4979f","observation_id":"6f6c7e3b-f613-4e7b-aa57-f37df9495d79","resolution":{"observed_at":"2026-08-07T12:09:15.974806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10512","last_updated":"2023-12-20T20:56:14Z","snapshot_observed_at":"2026-08-12T23:46:47.414754Z","submitted_at":"2023-03-18T22:36:25Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10512","snapshot_observed_at":"2026-08-07T12:09:16.082796Z","title":"Adalora: Adaptive budget allocation for parameter-efficient fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:09:16.082796Z"},"links":{"cited_paper":"/paper/2303.10512","citing_paper":"/paper/2506.00495"},"observation_digest":"sha256:9018dd35af7e246d95cf019d12cdbeaade3cea32d70d43de81794b29fa7564d5","observation_id":"f82c49eb-4f3b-4c9e-89a4-ce18d4b775f1","resolution":{"observed_at":"2026-08-07T12:09:16.082796Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00495","last_updated":"2025-05-31T10:27:08Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T08:35:41.766909Z","submitted_at":"2025-05-31T10:27:08Z","title":"FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":2,"verified_fuzzy":14},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 2 inbound Pith citation observations for arXiv:2506.00495."}