Pith. sign in

Paper Citation Record · LEDGER

Similarity-Aware Token Pruning: Your VLM but Faster

As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2503.11549.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2503.11549 v1

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 15 of 15 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-16T06:30:59.297886+00:00

measured 15 of 15 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-16T11:46:40.551415Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T15:59:57.424957Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation eb551b78-8c45-4b74-a5bf-c4ded5a4f597 · inbound

Video-MMLU: A Massive Multi-Discipline Lecture Understanding Benchmark cites this paper.

Video-MMLU: A Massive Multi-Discipline Lecture Understanding Benchmark Similarity-Aware Token Pruning: Your VLM but Faster

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-16T11:46:40.551415Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:46:40.551415Z digest=sha256:26c7b43d5cfa4134cb979d8edf9b923b23ecc37008c32ec772e72e01eb3d13ae

Observation 8e4ee5fe-b3d4-4fb5-864d-64b5088904fe · inbound

Beyond Attention or Similarity: Maximizing Conditional Diversity for Token Pruning in MLLMs cites this paper.

Beyond Attention or Similarity: Maximizing Conditional Diversity for Token Pruning in MLLMs Similarity-Aware Token Pruning: Your VLM but Faster

Reference 2019

Resolution
unresolved
no resolver link, observed 2026-08-07T04:20:31.175344Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:20:31.175344Z digest=sha256:1d6c1b800bcd2f9317fa2582ace69eec7d55374059fb32ba407c72b9f4397dbc

Observation 024ed357-3714-4cb4-b720-08028238635e · inbound

HAWK: Head Importance-Aware Visual Token Pruning in Multimodal Models cites this paper.

HAWK: Head Importance-Aware Visual Token Pruning in Multimodal Models Similarity-Aware Token Pruning: Your VLM but Faster

Reference 15

Resolution
verified exact
arxiv_id, observed 2026-05-11T07:01:06.116080Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-05-10T17:20:19.653806Z digest=sha256:88762dcf80a2798313cf952e32d574a75716f777b7f1ff9c4e3caa66b2550caf

Observation d5a38039-ef7a-4bb5-92cf-1a675bbca74c · inbound

RetentiveKV: State-Space Memory for Uncertainty-Aware Multimodal KV Cache Eviction cites this paper.

RetentiveKV: State-Space Memory for Uncertainty-Aware Multimodal KV Cache Eviction Similarity-Aware Token Pruning: Your VLM but Faster

Reference 36

Resolution
verified exact
arxiv_id, observed 2026-05-11T10:26:02.138347Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-05-10T15:29:17.567557Z digest=sha256:5706e8c142e66f837416156c5fb91b982081d5759b125fce09da65db24b22411

Observation ca5aa4e9-997a-4e54-a2b7-e1df500d4ff6 · inbound

VisMMOE: Exploiting Visual-Expert Affinity for Efficient Visual-Language MoE Offloading cites this paper.

VisMMOE: Exploiting Visual-Expert Affinity for Efficient Visual-Language MoE Offloading Similarity-Aware Token Pruning: Your VLM but Faster

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-05-11T16:36:06.620346Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-05-09T16:10:22.588945Z digest=sha256:4f2d31e4727da98e992713ed88627f516924ed6b3b258edb755b8d46db63c3ac

Observation e8bb49e9-c983-417c-b75d-cb3f87f50185 · inbound

DynaTok: Temporally Adaptive and Positional Bias-Aware Token Compression for Video-LLMs cites this paper.

DynaTok: Temporally Adaptive and Positional Bias-Aware Token Compression for Video-LLMs Similarity-Aware Token Pruning: Your VLM but Faster

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-20T06:58:06.004736Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-05-20T06:55:01.619441Z digest=sha256:f2c86e6cc82730a1559eeb5e09a5cca91ed738fc372a109f2b2c1e0e85aa23ea

Observation e37c1600-d6d6-4683-8888-1a566f0c04f9 · inbound

Beyond Surrogate Gradients: Fully Differentiable Token Pruning for Vision-Language Models cites this paper.

Beyond Surrogate Gradients: Fully Differentiable Token Pruning for Vision-Language Models Similarity-Aware Token Pruning: Your VLM but Faster

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-06-29T13:13:27.411246Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-06-29T13:07:21.789901Z digest=sha256:4182a3468b3b838f9eb55fc1c04c6e00d1a1ef12c23cf5aa975bfda04122efdd

Observation 23ea4db1-ac06-4d3f-9fbd-9107811bef42 · inbound

RAPID: Layer-Wise Redundancy-Aware Pruning and Importance-Driven Token Merging for Efficient ViT cites this paper.

RAPID: Layer-Wise Redundancy-Aware Pruning and Importance-Driven Token Merging for Efficient ViT Similarity-Aware Token Pruning: Your VLM but Faster

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-07-02T21:27:24.487816Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-06-27T19:46:23.188930Z digest=sha256:a46bac17bd51c3ff8994f551c571cb5cbe1ad506f9e413fde1d973c7488f8a51

Observation a1e3b4b9-1721-4539-9413-73f061516819 · inbound

AVIS: Adaptive Test-Time Scaling for Vision-Language Models cites this paper.

AVIS: Adaptive Test-Time Scaling for Vision-Language Models Similarity-Aware Token Pruning: Your VLM but Faster

Reference 41

Resolution
verified exact
arxiv_id, observed 2026-07-03T08:17:45.886204Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-06-27T10:47:41.183211Z digest=sha256:d4dce05502ead5ad8d0a724bc755cb214a3464c91cdace36f4288acb68f19b98

Observation 096ab6c4-a4bb-4e65-92ae-d45dcd9c0bb0 · inbound

Accelerating Multimodal Large Language Models with Prior-Corrected Token Reduction cites this paper.

Accelerating Multimodal Large Language Models with Prior-Corrected Token Reduction Similarity-Aware Token Pruning: Your VLM but Faster

Reference 31

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T15:59:56.757240Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-06-26T01:10:00.373247Z digest=sha256:eedd21fc66f5e173a40264fb93f2ff84e623ea98a8d5cd83f32fa80cb9e5a664

Observation 8d76fb6d-49a5-45e0-8371-e81fbe9c6771 · inbound

Spectral Evolution-Guided Token Pruning in Multimodal Large Language Models cites this paper.

Spectral Evolution-Guided Token Pruning in Multimodal Large Language Models Similarity-Aware Token Pruning: Your VLM but Faster

Reference 34

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T15:59:57.426487Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-06-26T01:04:20.802531Z digest=sha256:2cb057e637408b20bd050a0c5b4a9f8725dfdf1c2cfc7bae55953a730cae3f91

Observation e38bd0a8-f4a2-43fc-8418-9115e89b8aa6 · inbound

TOPS: First-Principles Visual Token Pruning via Constructing Token Optimal Preservation Sets for Efficient MLLM Inference cites this paper.

TOPS: First-Principles Visual Token Pruning via Constructing Token Optimal Preservation Sets for Efficient MLLM Inference Similarity-Aware Token Pruning: Your VLM but Faster

Reference 35

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T14:09:53.804242Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-06-26T04:24:38.917137Z digest=sha256:12dd50ad1c7d29e1aaab7f3e6deec9ae415eea57e5afb0bebc1013148a20dbab

Observation 9774a8cb-bf6f-4697-814e-07c4097cb51e · inbound

Attention-Free and Lightweight Token Reduction for Efficient Vision-Language Models cites this paper.

Attention-Free and Lightweight Token Reduction for Efficient Vision-Language Models Similarity-Aware Token Pruning: Your VLM but Faster

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-02T05:03:27.630859Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T05:03:27.630859Z digest=sha256:1b2e6a45e3169e0e9ad2506ca959e38d7633e2a40fad96cb24fc2e6ed0c8b68e

Observation 6db57410-b9af-47f3-b175-37c0f9f2f26a · inbound

C-PTQ: Fisher-weighted Channel-wise Sensitivity for Post-training Quantization of MLLMs cites this paper.

C-PTQ: Fisher-weighted Channel-wise Sensitivity for Post-training Quantization of MLLMs Similarity-Aware Token Pruning: Your VLM but Faster

Reference 65

Resolution
unresolved
no resolver link, observed 2026-08-01T08:35:55.672675Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T08:35:55.672675Z digest=sha256:1fbb9df219c5deb086ee6afdcc43f3a003d90d79d419093aacf79a176367e709

Observation acbe806f-1b20-4e4b-a766-b8adb443d60e · inbound

DiffPrune: differentiable information throttling for token pruning in vision-language models cites this paper.

DiffPrune: differentiable information throttling for token pruning in vision-language models Similarity-Aware Token Pruning: Your VLM but Faster

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-04T17:18:16.095066Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T17:18:16.095066Z digest=sha256:ce64e47cb60ce8118fe7f121744d7d135b04b1952c03f0085a88b6dc6ff034ec