Pith. sign in

Paper Citation Record · LEDGER

ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2410.06625.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2410.06625 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 16 of 16 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-15T06:32:42.880941+00:00

measured 16 of 16 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-12T05:56:46.354498Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-01T14:45:49.583188Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 2474ca4e-e866-4dc3-8446-10d964c193e0 · inbound

VLSBench: Unveiling Visual Leakage in Multimodal Safety cites this paper.

VLSBench: Unveiling Visual Leakage in Multimodal Safety ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-12T05:56:46.354498Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-12T05:56:46.354498Z digest=sha256:a7288512ca3f9091fea6c19e14c23dd1655add888ef8b3bfde647196879c2db8

Observation 9280adeb-be5e-47b6-9f7a-94c536b1025f · inbound

Analyzing Finetuning Representation Shift for Multimodal LLMs Steering cites this paper.

Analyzing Finetuning Representation Shift for Multimodal LLMs Steering ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-10T22:03:24.723180Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:03:24.723180Z digest=sha256:63dfe0c072cdec6d7bae0efd56e95e072a323ad632abc33631b56b1d1774bf37

Observation a3729146-d713-4eb7-8004-9220fe90bc84 · inbound

A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations cites this paper.

A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T19:45:18.216185Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T19:45:18.216185Z digest=sha256:2298b32e22b11c1691fa5301b41e78479e778579917d259760e1a56ee6b563d7

Observation 71c06227-c851-4b21-a88d-dc330c50fe68 · inbound

Seeing the Threat: Vulnerabilities in Vision-Language Models to Adversarial Attack cites this paper.

Seeing the Threat: Vulnerabilities in Vision-Language Models to Adversarial Attack ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T13:22:00.577809Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T13:22:00.577809Z digest=sha256:36268437dd2145e323bc812d806ea43efbcbe2f8b499aadf253027f4d8665ebf

Observation 10490e61-fe9e-4378-8a94-1dcea2e4c117 · inbound

Bootstrapping LLM Robustness for VLM Safety via Reducing the Pretraining Modality Gap cites this paper.

Bootstrapping LLM Robustness for VLM Safety via Reducing the Pretraining Modality Gap ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-07T12:37:20.634917Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:37:20.634917Z digest=sha256:7777748522f6dd35820b4e76f5f1a1c83cdbda72080299c92a627601751299fb

Observation 71bdcb01-8904-4e8f-96c7-830263e41da1 · inbound

AMIA: Automatic Masking and Joint Intention Analysis Makes LVLMs Robust Jailbreak Defenders cites this paper.

AMIA: Automatic Masking and Joint Intention Analysis Makes LVLMs Robust Jailbreak Defenders ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T12:35:26.553538Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:35:26.553538Z digest=sha256:95bc69c9103662999ba8f02876d6008a4db3420dcf69a1add033845b6c7387bf

Observation d39f1b4b-062a-4184-b81e-7ed8a721595d · inbound

Mitigating Object Hallucination via Robust Local Perception Search cites this paper.

Mitigating Object Hallucination via Robust Local Perception Search ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T05:53:58.538546Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T05:53:58.538546Z digest=sha256:c72391891e68b833b4221469872f2faaa28e5ef2f531ccefa7e891c0b9bef670

Observation 46b7d000-77e8-41a7-a883-caccc8755ba0 · inbound

Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities cites this paper.

Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-06T17:21:35.186888Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T17:21:35.186888Z digest=sha256:8a3c8b8ff2e6a4d38180221ff7d5cd85adc25150075642ad10496b966569bebe

Observation 101c3ec7-e871-4ef9-a72e-30496f0e8a9b · inbound

A Survey on Training-free Alignment of Large Language Models cites this paper.

A Survey on Training-free Alignment of Large Language Models ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-05T21:18:39.389808Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:18:39.389808Z digest=sha256:8f3aa3ba4efeed2ecf2985e84bd401ce39bb2a4677e6be1cee7e61fcb2a132a1

Observation 9044901f-3b95-4c4e-9c8d-d5160c9003fa · inbound

Empowering Multimodal LLMs with External Tools: A Comprehensive Survey cites this paper.

Empowering Multimodal LLMs with External Tools: A Comprehensive Survey ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 244

Resolution
unresolved
no resolver link, observed 2026-08-05T20:29:07.659178Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T20:29:07.659178Z digest=sha256:d91bbc54d0a649b657ce180cdd9048a5612191b61ffd15ea291d870c65a72249

Observation 34f8e112-816e-4c98-81cb-ba0ce7dd8714 · inbound

Attention Misses Visual Risk: Risk-Adaptive Steering for Multimodal Safety Alignment cites this paper.

Attention Misses Visual Risk: Risk-Adaptive Steering for Multimodal Safety Alignment ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 2009

Resolution
unresolved
no resolver link, observed 2026-08-04T09:47:23.180246Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T09:47:23.180246Z digest=sha256:f2d810a41d8fbab9a572f0cb53787483ecc07e99d9e3a4b1d7f7c11e85af763d

Observation cbfed91c-c0b4-4291-8d23-bcd3a87acbb2 · inbound

Targeted Interpretable Safety Neuron Enhancement for Multilingual Vision-Language Large Models cites this paper.

Targeted Interpretable Safety Neuron Enhancement for Multilingual Vision-Language Large Models ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-05-11T05:20:57.958576Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-05-10T18:12:34.909229Z digest=sha256:2b5064fac79215e6999029a110e7c15a2812653354ded8c2d94cf42b63fc7bf8

Observation fca7e6c5-d50e-4c32-8ea1-84d9756bbc11 · inbound

Targeted Interpretable Safety Neuron Enhancement for Multilingual Vision-Language Large Models cites this paper.

Targeted Interpretable Safety Neuron Enhancement for Multilingual Vision-Language Large Models ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-02T16:34:02.952337Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T16:34:02.952337Z digest=sha256:153b165bfa9951de7581a5e29186922d40b009904db36943e9a13cf5ecab9935

Observation 64bfa40e-666f-40c4-b59f-b8a0e6938496 · inbound

WARD: Adversarially Robust Defense of Web Agents Against Prompt Injections cites this paper.

WARD: Adversarially Robust Defense of Web Agents Against Prompt Injections ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 18

Resolution
verified exact
arxiv_id, observed 2026-07-01T14:45:49.584717Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-06-30T20:16:13.413064Z digest=sha256:20b5592f6a35b9295668ae31af9cc6d8099842ace860a9c0d24120a64beed815

Observation 55077588-5b9a-4486-83d6-82cb93ab2013 · inbound

Visual Token Compression Enhances Robustness of MLLMs cites this paper.

Visual Token Compression Enhances Robustness of MLLMs ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-01T13:10:37.290149Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T13:10:37.290149Z digest=sha256:01e6718748610445c068102a1ab99be28a9e3fcd44260d27bf79360e3708dcf2

Observation 27035e5d-4456-46c9-8155-230aefb14533 · inbound

One Anchor for All: Unified Multilingual and Multimodal Safety Alignment for LVLMs cites this paper.

One Anchor for All: Unified Multilingual and Multimodal Safety Alignment for LVLMs ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time

Reference 36

Resolution
unresolved
no resolver link, observed 2026-07-31T23:07:40.056533Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T23:07:40.056533Z digest=sha256:e10dff557efae1b5e5b202badc3e03daff7dd21ce579d993be7e5078495edb78