{"as_of":"2026-08-15T16:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:65d50147c5a195830b80fabf98fc81fe030c010c457761469f84fca9954c3a99","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:37:39.109971Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.12951/citation-record","integrity":"/paper/2412.12951/integrity","json":"/paper/2412.12951/citation-record.json","paper":"/paper/2412.12951"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.17604","last_updated":"2025-08-19T19:14:56Z","snapshot_observed_at":"2026-08-12T23:56:46.255255Z","submitted_at":"2024-05-27T19:07:13Z","title":"LoRA-XS: Low-Rank Adaptation with Extremely Small Number of Parameters","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17604","snapshot_observed_at":"2026-08-11T13:37:38.959932Z","title":"Lora-xs: Low-rank adaptation with extremely small number of parameters","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:38.959932Z"},"links":{"cited_paper":"/paper/2405.17604","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:e51d0b9aaf511df84e321a5236e3c1ff447d2c93b1b61e44d52e2034a1ebb3af","observation_id":"bb345255-2aad-4735-83ba-1ce1393706c9","resolution":{"observed_at":"2026-08-11T13:37:38.959932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07967","last_updated":"2023-10-16T15:52:20Z","snapshot_observed_at":"2026-08-14T07:04:49.109501Z","submitted_at":"2023-06-13T17:59:32Z","title":"One-for-All: Generalized LoRA for Parameter-Efficient Fine-tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07967","snapshot_observed_at":"2026-08-11T13:37:38.975262Z","title":"One-for-all: Gen- eralized lora for parameter-efficient fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:38.975262Z"},"links":{"cited_paper":"/paper/2306.07967","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:52ae09a4c31260389d3977e78edd4ae9b626452de8324b5fdb74a50c7657f688","observation_id":"d611bb79-8524-4824-a725-3b8f8a684f6b","resolution":{"observed_at":"2026-08-11T13:37:38.975262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04284","last_updated":"2022-11-10T12:48:10Z","snapshot_observed_at":"2026-08-13T14:09:41.870183Z","submitted_at":"2022-10-09T15:28:48Z","title":"SparseAdapter: An Easy Approach for Improving the Parameter-Efficiency of Adapters","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04284","snapshot_observed_at":"2026-08-11T13:37:38.989122Z","title":"Sparseadapter: An easy approach for improving the parameter-efficiency of adapters","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:38.989122Z"},"links":{"cited_paper":"/paper/2210.04284","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:5ac7f8fc198f5ffa304c5f0a7fcf787d341643ea1bcea848f1296bd0e7276cb1","observation_id":"fae90cd4-f1a1-4ce9-a1b3-424393506691","resolution":{"observed_at":"2026-08-11T13:37:38.989122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-06T15:24:34.790850Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-08-11T13:37:39.025487Z","title":"The power of scale for parameter-efficient prompt tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.025487Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:f3166e1890f8ef46e8872b38292d5d4fcba9bd5f1c8fea45fef7af04750ba600","observation_id":"70ba8ea8-e90b-49c6-a122-d4831967591a","resolution":{"observed_at":"2026-08-11T13:37:39.025487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11005","last_updated":"2022-05-23T02:43:45Z","snapshot_observed_at":"2026-08-15T14:04:48.407494Z","submitted_at":"2022-05-23T02:43:45Z","title":"Parameter-Efficient Sparsity for Large Language Models Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11005","snapshot_observed_at":"2026-08-11T13:37:39.038878Z","title":"Parameter-efficient sparsity for large language models fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.038878Z"},"links":{"cited_paper":"/paper/2205.11005","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:8805cff9afa618fceee3a66a83c4f7c221cc5e5f103bba606d879ea63ad3cfa5","observation_id":"43228dba-83be-4515-b305-06cf25f23d0a","resolution":{"observed_at":"2026-08-11T13:37:39.038878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10280","last_updated":"2024-08-27T15:34:49Z","snapshot_observed_at":"2026-08-15T06:11:36.581254Z","submitted_at":"2024-08-18T12:18:56Z","title":"NoRA: Nested Low-Rank Adaptation for Efficient Fine-Tuning Large Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10280","snapshot_observed_at":"2026-08-11T13:37:39.044748Z","title":"Nora: Nested low-rank adaptation for efficient fine-tuning large models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.044748Z"},"links":{"cited_paper":"/paper/2408.10280","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:5674155f8fa692fc7196cd29ab4a6dc54ecdfced17790c299a3e06b00ae2a49d","observation_id":"9534321c-2b14-4854-b86e-977c9c0ecf84","resolution":{"observed_at":"2026-08-11T13:37:39.044748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-11T13:37:39.051681Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.051681Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:d8cf8531ec3b615849519f8a84c9758fa0b6745babc687953b7ee454b8a28fa9","observation_id":"22da5c8f-a4da-46f6-a705-eeeca38ae19b","resolution":{"observed_at":"2026-08-11T13:37:39.051681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-11T13:37:39.058919Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.058919Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:1846fe705c86f3257f30cb16e37bc1ecb0608be2ee03842b73f3e17c6f5d1447","observation_id":"7900e55e-a855-4440-96ea-a5c8f17129ff","resolution":{"observed_at":"2026-08-11T13:37:39.058919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00247","last_updated":"2021-01-26T12:54:33Z","snapshot_observed_at":"2026-08-11T03:47:32.551562Z","submitted_at":"2020-05-01T07:03:42Z","title":"AdapterFusion: Non-Destructive Task Composition for Transfer Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00247","snapshot_observed_at":"2026-08-11T13:37:39.065819Z","title":"Adapterfusion: Non-destructive task composition for transfer learning","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.065819Z"},"links":{"cited_paper":"/paper/2005.00247","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:0acbcbe51075ba82dcb2cb59d892780adb5bf39bc7e744e9a2a96900199f9691","observation_id":"5969d639-2c32-4121-a031-fc2e550a8b9f","resolution":{"observed_at":"2026-08-11T13:37:39.065819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09920","last_updated":"2024-09-24T09:48:36Z","snapshot_observed_at":"2026-08-12T23:42:47.998106Z","submitted_at":"2024-06-14T11:02:21Z","title":"Knowledge Editing in Language Models via Adapted Direct Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09920","snapshot_observed_at":"2026-08-11T13:37:39.085414Z","title":"Knowledge editing in lan- guage models via adapted direct preference optimization.arXiv preprint arXiv:2406.09920,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.085414Z"},"links":{"cited_paper":"/paper/2406.09920","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:a4bc9979f06be2db5b39e53f24f7d113a293ac39ecfdebd6584d904faa1e5467","observation_id":"60fb603f-49ca-4d9e-a071-01d9c8b8f477","resolution":{"observed_at":"2026-08-11T13:37:39.085414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14717","last_updated":"2023-10-09T07:39:04Z","snapshot_observed_at":"2026-08-15T04:23:13.328430Z","submitted_at":"2023-09-26T07:22:23Z","title":"QA-LoRA: Quantization-Aware Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14717","snapshot_observed_at":"2026-08-11T13:37:39.098228Z","title":"Qa-lora: Quantization-aware low-rank adaptation of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.098228Z"},"links":{"cited_paper":"/paper/2309.14717","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:eb1828a18685b37c967bbfb2eadd5a470aef17d552579a2f755751355e220353","observation_id":"edd36266-ceea-4be3-a9e3-f06f940be680","resolution":{"observed_at":"2026-08-11T13:37:39.098228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03303","last_updated":"2026-05-09T05:30:15Z","snapshot_observed_at":"2026-08-13T08:01:16.750424Z","submitted_at":"2023-08-07T05:12:27Z","title":"LoRA-FA: Efficient and Effective Low Rank Representation Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03303","snapshot_observed_at":"2026-08-11T13:37:39.104166Z","title":"Lora-fa: Memory- efficient low-rank adaptation for large language models fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.104166Z"},"links":{"cited_paper":"/paper/2308.03303","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:01d8894915a109d017303b4cf48967fb1003ddd78b949ef958ef2f5acedf62b0","observation_id":"4cdab6a2-10f5-4154-b204-6b905bddb292","resolution":{"observed_at":"2026-08-11T13:37:39.104166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12200","last_updated":"2024-06-04T06:39:23Z","snapshot_observed_at":"2026-08-15T15:24:35.168536Z","submitted_at":"2024-01-22T18:39:40Z","title":"APT: Adaptive Pruning and Tuning Pretrained Language Models for Efficient Training and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12200","snapshot_observed_at":"2026-08-11T13:37:39.109971Z","title":"Apt: Adaptive pruning and tun- ing pretrained language models for efficient training and inference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.109971Z"},"links":{"cited_paper":"/paper/2401.12200","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:a31510e23f35ac0019a19de7c808d15b717b03dfbad41cc1c54163e8b8f8f8e6","observation_id":"cbffbc6e-f309-4b74-9466-41507d492341","resolution":{"observed_at":"2026-08-11T13:37:39.109971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.00408","last_updated":"2022-05-02T19:21:13Z","snapshot_observed_at":"2026-08-14T03:08:50.674760Z","submitted_at":"2022-04-01T13:09:56Z","title":"Structured Pruning Learns Compact and Accurate Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.00408","snapshot_observed_at":"2026-08-11T13:37:39.091398Z","title":"Structured pruning learns compact and accurate models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.091398Z"},"links":{"cited_paper":"/paper/2204.00408","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:c526182aa94af22cb3f3582d130bffa5e3180428f5350fca4cb772fbc71dbf9d","observation_id":"96c5b90a-b226-431f-b89f-30b89c2db25e","resolution":{"observed_at":"2026-08-11T13:37:39.091398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11454","last_updated":"2024-01-16T18:59:22Z","snapshot_observed_at":"2026-08-13T05:47:23.578307Z","submitted_at":"2023-10-17T17:59:46Z","title":"VeRA: Vector-based Random Matrix Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11454","snapshot_observed_at":"2026-08-11T13:37:39.015019Z","title":"Vera: Vector-based random matrix adaptation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.015019Z"},"links":{"cited_paper":"/paper/2310.11454","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:a5d596814dac8638ebb3f0c36e3b5c9c74a0c470de2df94b36669b5292c97aac","observation_id":"c54b1ee3-738c-4924-8ee5-168f49988073","resolution":{"observed_at":"2026-08-11T13:37:39.015019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T13:37:39.008120Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.008120Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:2ba4515b2edf3488bceca5e3a09b475f52498b5f86104769ad728edcfb330d16","observation_id":"e566352a-b8d7-4344-a89e-df74ff9a09fd","resolution":{"observed_at":"2026-08-11T13:37:39.008120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:37:39.073074Z","title":"Adarankgrad: Adaptive gradient-rank and moments for memory-efficient llms training and fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.073074Z"},"links":{"citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:21c76293bf5e47e8477f25cec3ce0dd2e96eb6c8c681b1bc4d50f272b9ae70ed","observation_id":"b6ea905d-3e74-4795-b540-3fd15a901fe5","resolution":{"observed_at":"2026-08-11T13:37:39.073074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00190","last_updated":"2021-01-01T08:00:36Z","snapshot_observed_at":"2026-08-12T12:37:28.207761Z","submitted_at":"2021-01-01T08:00:36Z","title":"Prefix-Tuning: Optimizing Continuous Prompts for Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00190","snapshot_observed_at":"2026-08-11T13:37:39.032181Z","title":"Prefix-tuning: Optimizing continuous prompts for genera- tion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:39.032181Z"},"links":{"cited_paper":"/paper/2101.00190","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:ec78d91de45855c7c5181a6021a6780171c1fbf6ef113009166bcc22114d9108","observation_id":"80f7dbd3-0b05-4750-ac40-522008e61992","resolution":{"observed_at":"2026-08-11T13:37:39.032181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-14T22:57:08.956233Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-11T13:37:38.999966Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:38.999966Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:08d63ef2bfa42288b4b007810c6b351f352086b76e3b4d7eb3581f5bb1f37c18","observation_id":"1c609644-d4c2-46a8-bfaf-0397e417528d","resolution":{"observed_at":"2026-08-11T13:37:38.999966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03432","last_updated":"2024-03-06T03:33:48Z","snapshot_observed_at":"2026-08-14T12:37:08.878133Z","submitted_at":"2024-03-06T03:33:48Z","title":"Mixture-of-LoRAs: An Efficient Multitask Tuning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03432","snapshot_observed_at":"2026-08-11T13:37:38.982037Z","title":"Mixture-of-loras: An efficient multitask tuning for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:38.982037Z"},"links":{"cited_paper":"/paper/2403.03432","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:f91e48fae8a2bab447d2841bb8d347b701c230dcc68bbdbb522a3f38535305f8","observation_id":"f4a3c265-805d-4a26-ad1d-978f1e2a96e0","resolution":{"observed_at":"2026-08-11T13:37:38.982037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06385","last_updated":"2024-09-03T16:36:06Z","snapshot_observed_at":"2026-08-12T23:46:21.330363Z","submitted_at":"2024-06-10T15:44:22Z","title":"Low-Rank Quantization-Aware Training for LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06385","snapshot_observed_at":"2026-08-11T13:37:38.968326Z","title":"Low-rank quantization-aware training for llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T13:37:38.968326Z"},"links":{"cited_paper":"/paper/2406.06385","citing_paper":"/paper/2412.12951"},"observation_digest":"sha256:1f8c47f85554c90521fc39bd498565d87737891a6e24effc94ebdd3cd6b117da","observation_id":"d150909c-3950-405c-8c12-b12358e4a58a","resolution":{"observed_at":"2026-08-11T13:37:38.968326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.12951","last_updated":"2024-12-17T14:33:05Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T07:14:19.114051Z","submitted_at":"2024-12-17T14:33:05Z","title":"FineGates: LLMs Finetuning with Compression using Stochastic Gates"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2412.12951."}