Pith. sign in

Paper Citation Record · LEDGER

SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 45 inbound Pith citation observations for arXiv:2403.07378.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2403.07378 v5

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 45 of 45 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 45 of 45 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-09T21:31:36.274586Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T03:19:31.562858Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation d80d77a5-31de-414d-a115-67f2644e30fc · inbound

ASVD: Activation-aware Singular Value Decomposition for Compressing Large Language Models cites this paper.

ASVD: Activation-aware Singular Value Decomposition for Compressing Large Language Models SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 22

Resolution
verified exact
arxiv_id, observed 2026-05-20T13:49:33.883372Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-20T13:49:33.747672Z digest=sha256:bd67e214cf1b1812aad85b55bb461dce9181b375ab2721c329b1baf5290e6edd

Observation 02c76ba8-868a-4dba-80db-639093b7b8b4 · inbound

A Survey on Efficient Inference for Large Language Models cites this paper.

A Survey on Efficient Inference for Large Language Models SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 229

Resolution
verified exact
arxiv_id, observed 2026-05-15T02:39:33.314091Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-15T02:39:33.007894Z digest=sha256:3da56ac7b78f2720980e46c493f8eb2b47ac89900e32cd1542d84510f256194d

Observation 27c2739e-a650-4553-8fc6-a3035abd9333 · inbound

Pivoting Factorization: A Compact Meta Low-Rank Representation of Sparsity for Efficient Inference in Large Language Models cites this paper.

Pivoting Factorization: A Compact Meta Low-Rank Representation of Sparsity for Efficient Inference in Large Language Models SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-09T21:31:36.274586Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T21:31:36.274586Z digest=sha256:05f4a7a36e22dc7a5c02a7d23b2850926d668c15e2b08a374a3899a6a0337d83

Observation d9efbab2-b86e-443c-bd56-e23eda345613 · inbound

LoR-VP: Low-Rank Visual Prompting for Efficient Vision Model Adaptation cites this paper.

LoR-VP: Low-Rank Visual Prompting for Efficient Vision Model Adaptation SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-09T17:23:26.312297Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T17:23:26.312297Z digest=sha256:bef8a23efb04d8e291f64c17421f3d376ba23aefb2c7af43294476869d453078

Observation 4d395912-3d91-429c-89e0-8e7b8e6dc102 · inbound

Dobi-SVD: Differentiable SVD for LLM Compression and Some New Perspectives cites this paper.

Dobi-SVD: Differentiable SVD for LLM Compression and Some New Perspectives SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-09T11:28:42.509299Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T11:28:42.509299Z digest=sha256:c38bcd944c81badc140c365f836b0ba23f8bc701a84a1791ed9686fd1f415bdb

Observation 38879018-8b76-4517-8e84-41a142a399dd · inbound

RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models cites this paper.

RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 2019

Resolution
unresolved
no resolver link, observed 2026-08-07T23:03:44.682214Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T23:03:44.682214Z digest=sha256:358ac1bf6095802aa2acaa0e54683ef598b4e0d1a4feaddcd315cf42752a09b1

Observation fdf7bb72-4faa-4705-af09-8fb17aee320c · inbound

A3 : an Analytical Low-Rank Approximation Framework for Attention cites this paper.

A3 : an Analytical Low-Rank Approximation Framework for Attention SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 16

Resolution
verified exact
arxiv_id, observed 2026-05-22T15:04:57.165066Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-22T15:02:33.864861Z digest=sha256:1b44dbdd95669cf495c2190a3f42d7a3a50628af10abf09a5b413d3b7aa18edc

Observation 603ecd6f-dbb6-4f96-bcc4-d59ffd567631 · inbound

LatentLLM: Attention-Aware Joint Tensor Compression cites this paper.

LatentLLM: Attention-Aware Joint Tensor Compression SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-07T14:36:28.168443Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:36:28.168443Z digest=sha256:0f0f4ba66d690fb0bb975becc3918d3e98fb0a97326ed43735b5a293d24d0102

Observation a71610c8-ddd5-4ca4-97b8-d56752f27135 · inbound

Multi-objective Large Language Model Alignment with Hierarchical Experts cites this paper.

Multi-objective Large Language Model Alignment with Hierarchical Experts SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-07T13:52:13.523455Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:52:13.523455Z digest=sha256:22088e2865e9586546910f8b616983dfcd53bedebb19dec2e82d03a5b9c0ba41

Observation 46b6a569-7155-4d36-9e62-c123388e4c4d · inbound

TuneComp: Joint Fine-tuning and Compression for Large Foundation Models cites this paper.

TuneComp: Joint Fine-tuning and Compression for Large Foundation Models SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-07T13:27:10.525787Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:27:10.525787Z digest=sha256:f6cbe7a9ba5e052f6426db4cd3077167e44fe94368cf470962c3fda5ad566a3c

Observation 3c936bf9-8629-4769-9bad-a0bf75ec2f29 · inbound

ProcrustesGPT: Compressing LLMs with Structured Matrices and Orthogonal Transformations cites this paper.

ProcrustesGPT: Compressing LLMs with Structured Matrices and Orthogonal Transformations SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-07T11:20:43.959675Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T11:20:43.959675Z digest=sha256:77645fae56238ebc44f3eac56ceaded573be2914141c8c39e554903bd23b066f

Observation 425cc9a5-9881-41dc-83e2-a397465c72f0 · inbound

Lag-Relative Sparse Attention In Long Context Training cites this paper.

Lag-Relative Sparse Attention In Long Context Training SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T04:10:49.095108Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:10:49.095108Z digest=sha256:9aa409a5e0fce72f994f4aba5d81d147779c48c54f73f4de941dcc2642d858dc

Observation d28d8526-f21d-4b60-a80e-fd3fbbe226a0 · inbound

DipSVD: Dual-importance Protected SVD for Efficient LLM Compression cites this paper.

DipSVD: Dual-importance Protected SVD for Efficient LLM Compression SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-06T22:58:09.427875Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T22:58:09.427875Z digest=sha256:d965c7ee8e34cc0acc87e4d5934905bf34560786d79d4998f0b0089ab7789fe6

Observation f9d01e2e-d6f0-440a-9805-27ff984b3b5c · inbound

Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging cites this paper.

Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-06T21:52:09.016078Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:52:09.016078Z digest=sha256:f4350ace6197e6bc8983de515f4947d831a1425d200b998a50f26098c69592a4

Observation 76f4d2c8-cbb9-41b7-8317-4905b7b5f3ef · inbound

MGAA: Multi-Granular Adaptive Allocation fof Low-Rank Compression of LLMs cites this paper.

MGAA: Multi-Granular Adaptive Allocation fof Low-Rank Compression of LLMs SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T20:21:03.896534Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:21:03.896534Z digest=sha256:7c457b236b06dc861b7a281782ac0a2ca1dfd24ef961d029969257b2a7d9f6f3

Observation a4ea2366-d946-44eb-a072-c469bfc42b59 · inbound

On Information Geometry and Iterative Optimization in Model Compression: Operator Factorization cites this paper.

On Information Geometry and Iterative Optimization in Model Compression: Operator Factorization SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 90

Resolution
unresolved
no resolver link, observed 2026-08-06T18:07:19.318002Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:07:19.318002Z digest=sha256:d2a5cc113054a6f00302549e0f296d8ce2fed3913da825dab298d8a9bb4ab6b1

Observation e9a7622b-e1e6-48bd-87af-b33efc4df0f4 · inbound

FlashSVD: Memory-Efficient Inference with Streaming for Low-Rank Models cites this paper.

FlashSVD: Memory-Efficient Inference with Streaming for Low-Rank Models SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-06T05:40:48.880739Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:40:48.880739Z digest=sha256:cfd0356f4efb734411fc0232a4b7ab69b99bf0843981986909a082ac04d93335

Observation cbb13c88-edb6-46cd-8234-35033c4a9936 · inbound

Not All Errors Are Created Equal: ASCoT Addresses Late-Stage Fragility in Efficient LLM Reasoning cites this paper.

Not All Errors Are Created Equal: ASCoT Addresses Late-Stage Fragility in Efficient LLM Reasoning SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-05T23:32:55.137735Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T23:32:55.137735Z digest=sha256:7ce16425c386398dd35e32832ad5891d964cebfc9dd16f0856cfa733e184a97e

Observation 2783caee-7c40-41e8-85d2-2e4abf28523d · inbound

PHLoRA: data-free Post-hoc Low-Rank Adapter extraction from full-rank checkpoint cites this paper.

PHLoRA: data-free Post-hoc Low-Rank Adapter extraction from full-rank checkpoint SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-04T17:22:08.987825Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-04T17:22:08.987825Z digest=sha256:764c9b5315cc7bd1604cc660befd52294d0d4634582df9c9fd6a54046d5ecdce

Observation ac15a219-9d00-47de-bc0b-5714605e54c0 · inbound

PanoLora: Bridging Perspective and Panoramic Video Generation with LoRA Adaptation cites this paper.

PanoLora: Bridging Perspective and Panoramic Video Generation with LoRA Adaptation SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-04T17:10:00.766899Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-04T17:10:00.766899Z digest=sha256:c3123282e0f22fe677c2e51a86e8a53ea15e47e7063babc2433d78a7bf3fc43f

Observation d362884c-1a04-4ac8-93cd-c40cc7ca3094 · inbound

Accelerating Attention with Basis Decomposition cites this paper.

Accelerating Attention with Basis Decomposition SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-04T12:54:35.258159Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-04T12:54:35.258159Z digest=sha256:09bec6d8e08270ecd9011fee8f68ade31dc56cba44bbd740952185f2e75eb869

Observation b7f2ea23-d96e-423f-8e5d-98f8cb8bc2eb · inbound

Activation-Informed Pareto-Guided Low-Rank Compression for Efficient LLM/VLM cites this paper.

Activation-Informed Pareto-Guided Low-Rank Compression for Efficient LLM/VLM SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-04T11:24:22.318841Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-04T11:24:22.318841Z digest=sha256:27e79d42bbdff581920be5cc25c282fd6e48bf24c7055bdd118ead6efd90c1a2

Observation e566924f-09bc-43da-935a-7e12356344d0 · inbound

Spectral Compact Training: Pre-Training Large Language Models via Permanent Truncated SVD and Stiefel QR Retraction cites this paper.

Spectral Compact Training: Pre-Training Large Language Models via Permanent Truncated SVD and Stiefel QR Retraction SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 7

Resolution
verified exact
arxiv_id, observed 2026-05-13T22:58:24.113741Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-05-13T22:54:02.492105Z digest=sha256:db1b26a287c9525cc253d1285a24660d441923ba0ee24cf8316ef8fbafc2e57b

Observation a3427884-8be7-4731-858f-9f2934042fdd · inbound

ScatterPrism: convergence for generative simulation and inverse problems in particle and nuclear physics cites this paper.

ScatterPrism: convergence for generative simulation and inverse problems in particle and nuclear physics SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 78

Resolution
unresolved
no resolver link, observed 2026-07-13T14:28:05.261852Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T14:28:05.261852Z digest=sha256:093ba8a96af40ea12de3011ab468c7db2f1dd4aea979835dfc03756170dbf236

Observation b5aef69f-b490-4e07-bc74-782011519ea6 · inbound

ScatterPrism: convergence for generative simulation and inverse problems in particle and nuclear physics cites this paper.

ScatterPrism: convergence for generative simulation and inverse problems in particle and nuclear physics SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 78

Resolution
unresolved
no resolver link, observed 2026-07-15T11:44:19.622453Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-15T11:44:19.622453Z digest=sha256:89ee6f9b8cfde15e01ae37edff6ed2c6616671453d7f3630ed6a8a3a5dbdc000

Observation f15eaf13-cfa2-4fdb-bf1a-c4d9a6e077f2 · inbound

ENEC: A Lossless AI Model Compression Method Enabling Fast Inference on Ascend NPUs cites this paper.

ENEC: A Lossless AI Model Compression Method Enabling Fast Inference on Ascend NPUs SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 52

Resolution
verified exact
arxiv_id, observed 2026-05-14T21:58:03.111139Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-14T21:56:38.684104Z digest=sha256:6c3a28bd65d44f63545ecfc53c0e389d721f18e2d41b8b553cbddab68117c8c9

Observation 57ba4f0c-557e-4e8c-ba3f-57dad5415f64 · inbound

RUQuant: Towards Refining Uniform Quantization for Large Language Models cites this paper.

RUQuant: Towards Refining Uniform Quantization for Large Language Models SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-05-13T17:38:02.581010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-13T17:36:53.861234Z digest=sha256:ac989a5dfc0132d30ac4a955f4938d898f78e9d9f5268d5bd0a187a72d7d191e

Observation 7390047b-36bf-4059-b948-bcd0d8684079 · inbound

SLaB: Sparse-Lowrank-Binary Decomposition for Efficient Large Language Models cites this paper.

SLaB: Sparse-Lowrank-Binary Decomposition for Efficient Large Language Models SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 15

Resolution
verified exact
arxiv_id, observed 2026-05-11T00:00:57.454047Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-10T18:43:15.746399Z digest=sha256:28d19ec177d503489cb5a36264d7492814214b2dc39892cc4da7da56a6f5baca

Observation 924077a1-a47a-4afc-86eb-8deeae27f178 · inbound

Technical Report: Activation Residual Hessian Quantization (ARHQ) for Low-Bit LLM Quantization cites this paper.

Technical Report: Activation Residual Hessian Quantization (ARHQ) for Low-Bit LLM Quantization SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-05-11T15:31:06.110103Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-05-09T19:52:00.373696Z digest=sha256:4c316482a1117686b86ba54075b8f5499827c4204646d9df4a6321514e51a675

Observation 0307d93b-80ff-4d76-94f5-ec59469d79a6 · inbound

Gated Subspace Inference for Transformer Acceleration cites this paper.

Gated Subspace Inference for Transformer Acceleration SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-05-12T10:41:31.912389Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-08T19:26:08.510348Z digest=sha256:bb31bce690bae454db486da4f6cbf988409497445efc4f40ce174f77c57bf7e9

Observation 374e4509-369e-4801-802e-e6f8e0d55149 · inbound

Bayesian Fine-tuning in Projected Subspaces cites this paper.

Bayesian Fine-tuning in Projected Subspaces SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 20

Resolution
verified exact
arxiv_id, observed 2026-05-11T04:00:56.224908Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-11T02:00:47.889194Z digest=sha256:05525eb7c65a3b6c56786a29a2359637a2a7ccd8c749466b33a0be0da58a7f82

Observation cd418ca3-a18b-4f75-a160-bca123859734 · inbound

Different Prompts, Different Ranks: Prompt-aware Dynamic Rank Selection for SVD-based LLM Compression cites this paper.

Different Prompts, Different Ranks: Prompt-aware Dynamic Rank Selection for SVD-based LLM Compression SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-05-12T07:41:33.702185Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-12T02:22:51.541981Z digest=sha256:28d5b5c4de6d609059f2bb357e1b9c42a154bfcc5f08397911d3b7e47ff9d217

Observation 07ddcaef-ecca-4c47-9fd5-48ffbead2726 · inbound

OSCAR: Offline Spectral Covariance-Aware Rotation for 2-bit KV Cache Quantization cites this paper.

OSCAR: Offline Spectral Covariance-Aware Rotation for 2-bit KV Cache Quantization SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 55

Resolution
verified exact
arxiv_id, observed 2026-05-20T12:18:16.479498Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-20T12:16:07.797702Z digest=sha256:5b784e212a8debdd825d0b87e3e351afa255784ae1e07a4287972599d34a165b

Observation 1da4aa86-d241-4838-a80e-f667a8aeedf4 · inbound

SAFE-SVD: Sensitivity-Aware Fidelity-Enforcing SVD for Physics Foundation Models cites this paper.

SAFE-SVD: Sensitivity-Aware Fidelity-Enforcing SVD for Physics Foundation Models SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 26

Resolution
verified exact
arxiv_id, observed 2026-05-20T13:03:17.858741Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-20T13:02:08.337788Z digest=sha256:e48164472bd08b93614ea1fe69b2c2659069c12b4e99644916680ba584443524

Observation ee3aa47c-55c3-4a00-8837-eeedf81114c5 · inbound

Dynamic Model Merging Made Slim cites this paper.

Dynamic Model Merging Made Slim SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 82

Resolution
verified exact
arxiv_id, observed 2026-05-20T15:18:25.352587Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-20T15:16:24.651868Z digest=sha256:f22604d9a6d22e052f942524c06a60b70d43bb96f97bf56d9c1153194b924813

Observation b78e8444-ed5b-4723-b033-28af686ae093 · inbound

Fast Tensorization of Neural Networks via Slice-wise Feature Distillation cites this paper.

Fast Tensorization of Neural Networks via Slice-wise Feature Distillation SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 32

Resolution
verified exact
arxiv_id, observed 2026-05-20T06:53:22.938186Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-20T06:53:09.576838Z digest=sha256:5158857fc31a142db34c22211c979d58b6f77f97f229d6db0bb1f25fd6a349f4

Observation 4b1ace13-9036-4784-b6cf-82a653365ac8 · inbound

Cross-Layer Subspace Coupling for LLM Compression: A Unifying Framework and Its Empirical Limits cites this paper.

Cross-Layer Subspace Coupling for LLM Compression: A Unifying Framework and Its Empirical Limits SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 4

Resolution
verified exact
arxiv_id, observed 2026-06-28T23:42:49.663178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-28T23:37:31.250346Z digest=sha256:44ee93eb3463a6a981fb8abc98f39a5b624b4aa207ad38a2567132b4217135b1

Observation 8384e62c-ecdf-45f3-ab2f-c433d527bbc6 · inbound

DREAM-S: Speculative Decoding with Searchable Drafting and Target-Aware Refinement for Multimodal Generation cites this paper.

DREAM-S: Speculative Decoding with Searchable Drafting and Target-Aware Refinement for Multimodal Generation SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 55

Resolution
verified exact
arxiv_id, observed 2026-06-28T19:02:34.656130Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-06-28T18:55:51.474956Z digest=sha256:590ba42ae73ed8b620d39b0720df0ae517a7481f978f54a67836b32b62796b79

Observation c5bcdfc0-214a-45d8-b9d2-762cc92422c7 · inbound

LASER: Loss-Aware Singular-value Decomposition and Rank Allocation for Efficient Low-Precision Vision-Language Models cites this paper.

LASER: Loss-Aware Singular-value Decomposition and Rank Allocation for Efficient Low-Precision Vision-Language Models SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 50

Resolution
verified exact
arxiv_id, observed 2026-06-28T19:12:34.694425Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-28T19:09:29.347284Z digest=sha256:fa68b70f2be27a26938e0413ab8bdeabdf962315cb92abd038fbf70fc79d5924

Observation 7dfc33ef-791d-4b9a-b53f-d82b22ccaa4b · inbound

Rethinking the Role of Tensor Decompositions in Post-Training LLM Compression cites this paper.

Rethinking the Role of Tensor Decompositions in Post-Training LLM Compression SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 45

Resolution
verified exact
arxiv_id, observed 2026-07-02T01:46:26.876797Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-28T11:31:25.851340Z digest=sha256:89f35db2e65fef10e0a9db21b002892c31307e471b60e95ad328254ac4982b38

Observation 7494c73c-7af1-4d4b-aeed-7756df2069d7 · inbound

SigmaScale: LLM Compression with SVD-based Low-Rank Decomposition and Learned Scaling Matrices cites this paper.

SigmaScale: LLM Compression with SVD-based Low-Rank Decomposition and Learned Scaling Matrices SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 8

Resolution
verified exact
arxiv_id, observed 2026-07-02T17:27:14.811163Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-06-27T22:04:32.524875Z digest=sha256:92c4bbd004d52fc8b25d6710da231543d8d4ae4d7bcdf5fff655d81574ed5b21

Observation 1d2cbcff-3302-4991-901b-2baa81d54828 · inbound

EinSort: Sorting is All We Need for Tensorizing LLM cites this paper.

EinSort: Sorting is All We Need for Tensorizing LLM SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 84

Resolution
verified exact
arxiv_id, observed 2026-07-02T22:57:26.723076Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-06-27T18:31:01.804061Z digest=sha256:9ebac45929f09efa75add9eff7eed4758f0406d9e13dde0fe8f92d7086e0c36a

Observation 8e0d0922-ef57-4a25-9db2-0b749a17b65b · inbound

Activation- and Influence-Aware Ranks (AIR): Function-Preserving SVD Compression for LLMs cites this paper.

Activation- and Influence-Aware Ranks (AIR): Function-Preserving SVD Compression for LLMs SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 200

Resolution
verified exact
arxiv_id, observed 2026-07-04T03:19:31.565268Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-06-26T18:09:17.414031Z digest=sha256:27b48c137f6f8adc7a5e406b631c32dc9f42f40bf73e4e23a2a9f6847ff62dde

Observation de59e951-7fda-4eb0-9d94-37b4f30fcdd9 · inbound

Spectral Rewiring for Exploration, Purification, and Model Merging cites this paper.

Spectral Rewiring for Exploration, Purification, and Model Merging SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 14

Resolution
unresolved
no resolver link, observed 2026-07-12T05:08:55.438431Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T05:08:55.438431Z digest=sha256:1e96346a813e38496decbbd3b285898ca079b557175097fe0b9fb2b5d88c44a4

Observation 245a8636-a6b7-4fb2-a673-49f55ef09d23 · inbound

Break Through the Compression Bottleneck: From Theory to Practice cites this paper.

Break Through the Compression Bottleneck: From Theory to Practice SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-02T14:29:28.021172Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-02T14:29:28.021172Z digest=sha256:b1292d48f360a229af5c45dd8e919456e341771fe8f2b439a6fb78fa36fa9a33