{"as_of":"2026-08-09T22:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d8d82623f2a1c2c7121f391b89f4a031af9cf49e1980fbed8930b019e9f511f1","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T00:26:05.310741Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.03884/citation-record","integrity":"/paper/2502.03884/integrity","json":"/paper/2502.03884/citation-record.json","paper":"/paper/2502.03884"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.614924Z","title":"A survey on evaluation of large language models","venue":null,"work_id":"8166524d-5e6d-4a9b-a672-2c45c65ef558","year":2024},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.206525Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:335d711f17d72b128f9f0f00a4f96402640079e4b2d3dacccf1dbee2e40f54d0","observation_id":"b862c3bc-00b8-4c60-9541-8ca000df6a8e","resolution":{"observed_at":"2026-08-09T00:26:05.618170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.597201Z","title":"Qlora: Efficient fine- tuning of quantized llms","venue":null,"work_id":"5a14f06c-f6fc-49c0-bf18-bc83bc89d57f","year":2024},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.213503Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:286663ea0927579c12d66c6551a70aabba91040d8cec187fda1f712efb24f7eb","observation_id":"5f67a3fb-5490-419c-b9f6-b6f4bddaef38","resolution":{"observed_at":"2026-08-09T00:26:05.600642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.588530Z","title":"Loramoe: Alleviating world knowledge forgetting in large language models via moe-style plugin","venue":null,"work_id":"b92e5cd9-9fce-4fe2-9bd8-4528bbed4ee4","year":2024},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.217045Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:35ffa8932162ae497573b0ad8d4179a1d4ddcc0ababfe9c15ee1c9e848332bfc","observation_id":"35d77e59-1004-4f6d-b6f5-5ef3294885b7","resolution":{"observed_at":"2026-08-09T00:26:05.591718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.579865Z","title":"Glam: Efficient scaling of language models with mixture- of-experts","venue":null,"work_id":"19fede99-5eb9-4d68-a59e-1db732cbb7d0","year":2022},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.220317Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:bb2794d7e555be6014a024d26857af6bcc1e91313c311e32ab4f1fdf13c67e77","observation_id":"96dae0cf-a698-444a-a428-87e8ba1e363f","resolution":{"observed_at":"2026-08-09T00:26:05.583043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08562","last_updated":"2024-02-13T16:04:21Z","snapshot_observed_at":"2026-07-06T17:29:34.813390Z","submitted_at":"2024-02-13T16:04:21Z","title":"Higher Layers Need More LoRA Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08562","snapshot_observed_at":"2026-08-09T00:26:05.227041Z","title":"Higher layers need more lora experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.227041Z"},"links":{"cited_paper":"/paper/2402.08562","citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:dd993db7de10f92fd428a170a1c8bb96754622ddcbf0378e58f99f483c59a8dc","observation_id":"5dd8a9dd-b79d-434c-9eaa-d518eef1847f","resolution":{"observed_at":"2026-08-09T00:26:05.227041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14608","last_updated":"2024-09-16T02:54:50Z","snapshot_observed_at":"2026-08-04T09:07:42.158421Z","submitted_at":"2024-03-21T17:55:50Z","title":"Parameter-Efficient Fine-Tuning for Large Models: A Comprehensive Survey","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14608","snapshot_observed_at":"2026-08-09T00:26:05.230497Z","title":"Parameter-efficient fine- tuning for large models: A comprehensive survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.230497Z"},"links":{"cited_paper":"/paper/2403.14608","citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:ef778a430c7ee1d361a8cede2ad51862298748aa8579a09bb499c8afe079f4a5","observation_id":"31edfba0-dbb4-404a-bf4c-c46d75abf908","resolution":{"observed_at":"2026-08-09T00:26:05.230497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.566028Z","title":"Lora+: Efficient low rank adaptation of large models","venue":null,"work_id":"e67fd176-bd21-4ad1-af6d-6b06ddda361b","year":2024},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.233857Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:090edf46d86b998d38a02a42d444a1d2933d99e9a89a1411299ac1dadf5ccc6f","observation_id":"1d0cc5e4-843b-41ec-822d-2e8b20a45221","resolution":{"observed_at":"2026-08-09T00:26:05.569066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.557415Z","title":"Parameter-efficient transfer learning for nlp","venue":null,"work_id":"e3781950-9aa2-4070-a57b-010222ed32e3","year":2019},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.236940Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:ba3c6751569feec65b808e5d4837f97bd21ff719629b88cafefe3cc857aae34b","observation_id":"7e7fa0a2-6eda-4973-8b48-856e02ef725d","resolution":{"observed_at":"2026-08-09T00:26:05.560832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.539030Z","title":"Harder tasks need more experts: Dynamic routing in moe mod- els","venue":null,"work_id":"6eb02e18-e42f-4dc1-9537-37983c2c401c","year":2024},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.243594Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:40b84ecd06f0d5bf050d15d2132e3a1b4b91eb4beeb4c9df63dc6a345ba804d7","observation_id":"8d36c390-b455-4bd0-8148-d23742f39920","resolution":{"observed_at":"2026-08-09T00:26:05.542500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.529779Z","title":"Adaptive mix- tures of local experts","venue":null,"work_id":"8ec90a57-04af-440c-94f1-f52e891909f3","year":1991},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.246724Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:e0941cdfc30cb0abcf8a68d58817de32338a9bad8c1cf8484db0ab48d7d6fb0c","observation_id":"d6f04330-20f2-465c-ac58-ef062d5a9ff7","resolution":{"observed_at":"2026-08-09T00:26:05.532936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.511059Z","title":"Gshard: Scaling giant models with conditional computa- tion and automatic sharding","venue":null,"work_id":"c783d1a0-1569-4346-9d69-3e5f30d799cc","year":2021},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.252873Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:0a2d213230c99e634c82f2295da9998c6da2abe4f6758a04978d1e0a68035fca","observation_id":"3be8d3ee-24ce-4fea-84f5-217c2fa72aad","resolution":{"observed_at":"2026-08-09T00:26:05.514589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.492691Z","title":"Prefix- tuning: Optimizing continuous prompts for generation","venue":null,"work_id":"bae20b28-74db-4af5-aa40-44798b460ec5","year":2021},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.259314Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:7f4bbcd4491366f6851826369eaecc91c00685fb2c555d8f60603c1251a11d20","observation_id":"88492b77-2f3a-48e3-94a1-188bb4436969","resolution":{"observed_at":"2026-08-09T00:26:05.496140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15159","last_updated":"2024-07-20T02:26:49Z","snapshot_observed_at":"2026-08-07T09:36:34.166140Z","submitted_at":"2024-04-22T02:15:52Z","title":"MixLoRA: Enhancing Large Language Models Fine-Tuning with LoRA-based Mixture of Experts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15159","snapshot_observed_at":"2026-08-09T00:26:05.262430Z","title":"Mixlora: Enhancing large language models fine- tuning with lora based mixture of experts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.262430Z"},"links":{"cited_paper":"/paper/2404.15159","citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:677744e1cf5ccf2072ea44a9f161c3cfb315cabb7dab76763e02b61205fd2869","observation_id":"9cb577ec-e8ce-4346-a649-a7084e949904","resolution":{"observed_at":"2026-08-09T00:26:05.262430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.482619Z","title":"Learn to ex- plain: Multimodal reasoning via thought chains for sci- ence question answering","venue":null,"work_id":"b5573d2c-f1ef-45e6-b2ca-87d03f03403a","year":2022},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.265680Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:eed589f9e62b40382eb09feac3a2ade03ad42ad2e38a6a95a6a52b8e42410b4c","observation_id":"f9c4d36b-7e27-48d6-aa18-9a705494613b","resolution":{"observed_at":"2026-08-09T00:26:05.486504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.472547Z","title":"Can a suit of armor con- duct electricity? a new dataset for open book question an- swering","venue":null,"work_id":"2894929a-4e91-4d0e-9e33-9bcf96c553a8","year":2018},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.268990Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:26de9d4914df3db67b9393a138b7ce5fa7a40db8fcb150395460e69f2a392a2f","observation_id":"0f3d2e9c-8792-4b45-8d72-cee32c5e99c4","resolution":{"observed_at":"2026-08-09T00:26:05.476142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.453705Z","title":"Alphalora: Assigning lora experts based on layer training quality","venue":null,"work_id":"67685485-2b27-45b8-9a9f-c6ff32853065","year":2024},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.274643Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:b3cf85fa5adbf035e12d5e43e9cbeb86740ada4ab24a3e39b8c16579a727a2fe","observation_id":"41587668-7476-456c-b892-dcc884480144","resolution":{"observed_at":"2026-08-09T00:26:05.456912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.277593Z","title":"Scaling vision with sparse mixture of experts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.277593Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:1724c849c2f7fcd52aa977354490f6ded5be842b5dda403488593bf64e72095e","observation_id":"ac3c672e-5152-4bbc-936f-060f344b019d","resolution":{"observed_at":"2026-08-09T00:26:05.277593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.439685Z","title":"Hash layers for large sparse mod- els","venue":null,"work_id":"0b5bf4ae-5832-4a6f-8560-608a6d259e2e","year":2021},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.280812Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:beabe1cf297c00808d12ca851188ef4eaa9c39def3a8515de9b26927f96d8fa6","observation_id":"895c8a30-f7df-487d-b9e9-8969837719c7","resolution":{"observed_at":"2026-08-09T00:26:05.442901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.430514Z","title":"Commonsenseqa: A question answering challenge targeting commonsense knowledge","venue":null,"work_id":"0f29a7fd-9a4b-4453-b4e7-3536513ceb01","year":2019},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.283795Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:c41db23c01579e3873bc247f95d44b2bbe4a422d3d8d6448bb27ff698ebcb5cd","observation_id":"b83c8b17-d7f7-4207-9f8d-e2f1dc9fa41f","resolution":{"observed_at":"2026-08-09T00:26:05.433804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-09T00:26:05.286874Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.286874Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:d938c7dcc0b5240396a0a0e0fa37ac3e1175c683e834ff039286d691fe93d5ae","observation_id":"a13da25f-642e-42ca-acd6-721fc7a9b1a9","resolution":{"observed_at":"2026-08-09T00:26:05.286874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02731","last_updated":"2024-09-24T14:14:40Z","snapshot_observed_at":"2026-07-06T17:11:58.725249Z","submitted_at":"2024-01-05T09:58:09Z","title":"Parameter-Efficient Sparsity Crafting from Dense to Mixture-of-Experts for Instruction Tuning on General Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02731","snapshot_observed_at":"2026-08-09T00:26:05.296940Z","title":"Parameter-efficient sparsity crafting from dense to mixture-of-experts for instruction tuning on gen- eral tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.296940Z"},"links":{"cited_paper":"/paper/2401.02731","citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:c8f65c9e2dbc1a7f769ccf8a56ed0ae83d612cd49952dd35a0e10fde13633641","observation_id":"e32b3fa7-b9e7-4485-9bb8-363f58235f74","resolution":{"observed_at":"2026-08-09T00:26:05.296940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11260","last_updated":"2024-02-17T12:25:31Z","snapshot_observed_at":"2026-07-06T17:31:33.340510Z","submitted_at":"2024-02-17T12:25:31Z","title":"MoRAL: MoE Augmented LoRA for LLMs' Lifelong Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11260","snapshot_observed_at":"2026-08-09T00:26:05.300812Z","title":"Moral: Moe aug- mented lora for llms’ lifelong learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.300812Z"},"links":{"cited_paper":"/paper/2402.11260","citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:348d68b9666b6e5a41fcdcc8e508c5d4f552029be6121e1a5fad017258b55284","observation_id":"3db82f3a-efc2-4ede-98c4-1e601e4bf402","resolution":{"observed_at":"2026-08-09T00:26:05.300812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.406566Z","title":"Xmoe: Sparse models with fine-grained and adaptive expert se- lection","venue":null,"work_id":"944d89b3-ae2b-4363-895a-924b15d150e7","year":2024},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.304503Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:47eb626eeada69f863e7426880e7c32d2eb49a38140726c770e4fb21c3223924","observation_id":"94cc8bc0-d0de-4f9c-8b49-f8a6bc49ca4f","resolution":{"observed_at":"2026-08-09T00:26:05.409859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.397079Z","title":"Adamoe: Token- adaptive routing with null experts for mixture-of-experts language models","venue":null,"work_id":"fb225d91-bc7d-43ff-9f1e-a0377afac102","year":2024},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.307620Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:dfbaf00b54d870edba583504bae69e2d0c456ca9b3d51f927ed971a94542d727","observation_id":"f0dea8cb-847c-486d-89f8-cb17503e4b1e","resolution":{"observed_at":"2026-08-09T00:26:05.400436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.385164Z","title":"Mixture-of-experts with expert choice routing","venue":null,"work_id":"62e19907-40b6-4f5c-8271-113becb6c387","year":2022},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.310741Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:f6f57c45b5e36b242eed4c2dcc84011bc8f779344be9dad329273d8e7959d06d","observation_id":"1f6bf3ae-769a-4653-81dd-23d6822969ca","resolution":{"observed_at":"2026-08-09T00:26:05.390357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.520173Z","title":"Vera: Vector-based random matrix adaptation","venue":null,"work_id":"e955954a-0fa0-445b-ac16-7fe6231c827c","year":2024},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.249763Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:293eda04b198b7203580ae63757f05e60685c11f6a996457b305a002f3a80e75","observation_id":"ebec409b-746f-4247-a1a7-098a29718c3e","resolution":{"observed_at":"2026-08-09T00:26:05.523562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.415843Z","title":"Glue: A multi-task benchmark and analysis platform for natural language understanding","venue":null,"work_id":"71cf35e4-5cdd-4eb3-ad69-323f6eb63315","year":2019},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.293824Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:36e357c750e128d0bfbada985130d591f4ab0c2878cc39048750bddae7086549","observation_id":"cac6bcff-8588-455c-955c-8556a90ec3f4","resolution":{"observed_at":"2026-08-09T00:26:05.419326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.462997Z","title":"Mul- timodal contrastive learning with limoe: the language- image mixture of experts","venue":null,"work_id":"932dc430-3981-47dd-a6b4-5b9b2c7f8d2e","year":2022},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.271874Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:bf4552db367857e3b1f73e8413f5d0bf67d0e6dc89bec5dacdecdaf9896f2c95","observation_id":"b4304389-fac6-48c8-a1cf-4da1303a624c","resolution":{"observed_at":"2026-08-09T00:26:05.466505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.548469Z","title":"Lora: Low-rank adaptation of large language mod- els","venue":null,"work_id":"42c828e6-f927-4d11-873f-c480ef813e97","year":2022},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.240397Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:7ff72363cdd02397944ab67b48560ccb3da2e1897381df333b2061d16b81d484","observation_id":"079040a4-e268-4004-b6a7-44b7d53d6499","resolution":{"observed_at":"2026-08-09T00:26:05.551804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.501811Z","title":"The power of scale for parameter-efficient prompt tuning","venue":null,"work_id":"702e48f1-5bdf-4045-99fd-924c0f05fae8","year":2021},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.256133Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:20d11164fc5bd63de736c2c1979fc8a7eab26ae1fd2c176c4f4149f7e071a238","observation_id":"cb8743ae-9c25-492f-b201-204851d03ec8","resolution":{"observed_at":"2026-08-09T00:26:05.505038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.223668Z","title":"Switch transformers: Scaling to trillion param- eter models with simple and efficient sparsity","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.223668Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:749c1163a5a73d83ef8228cb79d2f277180a44fd0c0e1674ceb87f2152bae555","observation_id":"2e061d58-8c4a-4ed8-965e-2e0a19b3470b","resolution":{"observed_at":"2026-08-09T00:26:05.223668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.290362Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.290362Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:7dc0ae1e26b7abae9e119ca998254c553697c2ee72942a330c8377d15180cdcc","observation_id":"49c68872-daee-4356-bd72-109067ede51a","resolution":{"observed_at":"2026-08-09T00:26:05.290362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:26:05.606402Z","title":"Deepseek- moe: Towards ultimate expert specialization in mixture- of-experts language models","venue":null,"work_id":"bc681878-234c-4c4f-9a15-7e862086de9a","year":2024},"citing_paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T00:26:05.210228Z"},"links":{"citing_paper":"/paper/2502.03884"},"observation_digest":"sha256:de0d57b074de981b07f12eb3aff49bf4de8b6e27ec43fa387977b81549512a4a","observation_id":"19c7e156-59f2-4ce9-bcd0-9c6802229211","resolution":{"observed_at":"2026-08-09T00:26:05.609529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.03884","last_updated":"2025-02-06T08:58:03Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T00:19:38.091491Z","submitted_at":"2025-02-06T08:58:03Z","title":"Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2502.03884."}