Pith. sign in

Paper Citation Record · LEDGER

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models

As of 20 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 5 inbound Pith citation observations for arXiv:2506.05140.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.05140 v2

Coverage vector

measured 71 of 71 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T10:28:45.760195Z

measured 76 of 76 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 5 of 5 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-14T04:29:37.954753Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-13T20:58:15.805732Z

Reference resolution

71 of 71 outbound references displayed

  • verified exact0
  • verified fuzzy53
  • unresolved18
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation d255a0df-3d68-409c-b1c0-c4e4b494e658 · outbound

This paper cites A Survey of Large Language Models.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models A Survey of Large Language Models

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:39.289563Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:39.289563Z digest=sha256:ad649e23c6b9eaf5505963424c0c1df5080afc2834af10b95cf6a420d1cf4415

Observation 09a13ad8-30a3-4816-90a7-3fe3e762fe76 · outbound

This paper cites The Llama 3 Herd of Models.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models The Llama 3 Herd of Models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:39.368889Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:39.368889Z digest=sha256:68145cf95363fec4a216a763acb28c751b6c15c7fbf01a483546563c7664fcfd

Observation 3e11c524-40f8-470b-ace5-40f1b20f116c · outbound

This paper cites GPT-4o System Card.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models GPT-4o System Card

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:39.425083Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:39.425083Z digest=sha256:5c4179980ee829a7e54cd0120c9579dc7e9be4e1d3a1897d813ec2c0735b076a

Observation 74343a86-4951-42cf-b9ba-192289de4466 · outbound

This paper cites Listen, think, and understand,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Listen, think, and understand,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:56.449419Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:39.511419Z digest=sha256:d15a4e5eaf9a4340d6ee54fbaf4f02ec9164be36b58205915f4eee9b60e64b3e

Observation 06c2db3d-8dc4-43c5-93ed-13457067cb84 · outbound

This paper cites Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:39.609105Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:39.609105Z digest=sha256:8e018ddc792786f5e730318b9e5fcd28f9499bd5356a8764f57d3fa5e3f7266b

Observation f9d1cb11-b26b-4789-89c6-6ab6f631035e · outbound

This paper cites Qwen2-Audio Technical Report.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Qwen2-Audio Technical Report

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:39.675867Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:39.675867Z digest=sha256:aa116100385239c967629f68d5275547bbcb31075f60438122d37ac5b9fb5f06

Observation 0aa6d605-d714-4d2c-aec3-1d12316476a5 · outbound

This paper cites Developing instruction-following speech language model without speech instruction-tuning data,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Developing instruction-following speech language model without speech instruction-tuning data,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:56.244037Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:39.744849Z digest=sha256:8642359342ab4fe491fe9e0c534618bfd264c00eb488f718b91ed78b7dd22edc

Observation 268f2fec-eaef-4029-b141-05f4e0660226 · outbound

This paper cites Gama: A large audio- language model with advanced audio understanding and complex rea- soning abilities,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Gama: A large audio- language model with advanced audio understanding and complex rea- soning abilities,

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:56.069942Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:39.817469Z digest=sha256:97f548261345b554a7955d0278e930972c1c66f5e889d8a76654d7cacfe92b9b

Observation e83d794b-92f2-4d92-bab5-8f4112697b21 · outbound

This paper cites Desta: Enhancing speech language models through descriptive speech-text alignment,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Desta: Enhancing speech language models through descriptive speech-text alignment,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:55.881715Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:39.893515Z digest=sha256:8c2e38852d38d2f02765a15f89fbb4a1e474521743f50dd10d6d463dba6ab76a

Observation b1ef3cf5-5cc5-493c-b006-a94f6d3ef0fe · outbound

This paper cites Speech- copilot: Leveraging large language models for speech processing via task decomposition, modularization, and program generation,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Speech- copilot: Leveraging large language models for speech processing via task decomposition, modularization, and program generation,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:55.670146Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:39.944369Z digest=sha256:d3abc6026a90935606fe779bc0a682b24ae44f158377c8e10092bc6e44420ba9

Observation 80086a8e-fdc5-4f4e-a2bb-53e7a2c60d6c · outbound

This paper cites Joint audio and speech understanding,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Joint audio and speech understanding,

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:55.460892Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:40.030275Z digest=sha256:c0defb0733084e84e983c567017701b011b83a8101816423f8bbbaf82eb2c38f

Observation 42ea304d-b4fb-4fa3-a560-e4a5fcde6884 · outbound

This paper cites SALMONN: Towards generic hearing abilities for large language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models SALMONN: Towards generic hearing abilities for large language models,

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:55.289586Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:40.127663Z digest=sha256:921eb359b76dce571ad29bd28db13877d3b970f79f75de5ff851bda1afeb310b

Observation 7288f801-6165-4eab-aa62-3ccff0ea25e8 · outbound

This paper cites Blsp-emo: Towards empathetic large speech-language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Blsp-emo: Towards empathetic large speech-language models,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:55.099265Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:40.209530Z digest=sha256:adfcce51c4d40defa2be1f1a03ce460475984ff006f0f2d464983adc62f9920a

Observation d3296e3e-e49b-46ab-8237-1dc6ffb0ccf7 · outbound

This paper cites Wavllm: Towards robust and adaptive speech large language model,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Wavllm: Towards robust and adaptive speech large language model,

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:54.892249Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:40.279680Z digest=sha256:1ea6b3fbfe6ee564c8e98e56b5b6b255dc5d0e5e88e3de4959621203efb73431

Observation d6326ed4-33da-4b47-a841-0c12665efe2a · outbound

This paper cites Dynamic-SUPERB phase-2: A collaboratively expanding benchmark for measuring the capabilities of spoken language models with 180 tasks,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Dynamic-SUPERB phase-2: A collaboratively expanding benchmark for measuring the capabilities of spoken language models with 180 tasks,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:54.718898Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:40.359251Z digest=sha256:780fb41ebed75871ec6d3f9505903619acfbbf3c26260c09f244d4fbdce81a13

Observation 4e271325-a613-4d92-ab4b-3f8917f15ed5 · outbound

This paper cites AIR-bench: Benchmarking large audio-language models via generative comprehension,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models AIR-bench: Benchmarking large audio-language models via generative comprehension,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:54.568234Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:40.445257Z digest=sha256:7b5ff3c8191ea0a0dbc12ab4451725746d138285465bfb5d750af5b8f8e6bb68

Observation 261eee84-01c6-4106-9279-3b23d98e4978 · outbound

This paper cites MMAU: A massive multi- task audio understanding and reasoning benchmark,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models MMAU: A massive multi- task audio understanding and reasoning benchmark,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:54.372004Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:40.534392Z digest=sha256:cca8ee29db145d182d124aaf59e1527f1a7f6c2a6102681ba2a31ac9f467fcaf

Observation ae3d2463-73c5-43c8-8ffa-27f2a4a310bd · outbound

This paper cites SD-eval: A benchmark dataset for spoken dialogue understanding beyond words,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models SD-eval: A benchmark dataset for spoken dialogue understanding beyond words,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:54.212745Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:40.610768Z digest=sha256:7d90bef99943881261538d0660fdbe33958fea0fc282348ae459423d97d929f5

Observation 3f1de721-b173-43c7-861d-358b2804662d · outbound

This paper cites Audiobench: A universal benchmark for audio large language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Audiobench: A universal benchmark for audio large language models,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:53.957156Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:40.679645Z digest=sha256:82ed89cd2c1d95b9102131419863dc27759b976e8be9125c3088c914efb3a71b

Observation 6cf1eb72-eeaf-4b9d-8c4c-2781d612b8b9 · outbound

This paper cites Sakura: On the multi- hop reasoning of large audio-language models based on speech and audio information,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Sakura: On the multi- hop reasoning of large audio-language models based on speech and audio information,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:53.774159Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:40.743369Z digest=sha256:992c34135d219d7df417b5235e7c2eb059cfaa7caa404dcf4657e4fff35c554b

Observation 3c7cc759-9795-4eb5-945d-edce1eeb0748 · outbound

This paper cites Towards Holistic Evaluation of Large Audio-Language Models: A Comprehensive Survey.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Towards Holistic Evaluation of Large Audio-Language Models: A Comprehensive Survey

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:40.806283Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:40.806283Z digest=sha256:edab377bdf224a80e2d4dbfa61277212987777d767c5008eaf52f22d1ef0fba6

Observation 63a5ae1d-f3b6-4eb2-8f1b-02d5633e1e7e · outbound

This paper cites A Preliminary Exploration with GPT-4o Voice Mode.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models A Preliminary Exploration with GPT-4o Voice Mode

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:40.942515Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:40.942515Z digest=sha256:3f83ce1ee0f27fe9b6dc3608f7489c5e766746ad95eb25d2f8ca9b2f5cc8b316

Observation 08f9681f-dccd-4625-9f1f-ae80d6dbca1b · outbound

This paper cites Language-specific neurons: The key to multilingual ca- pabilities in large language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Language-specific neurons: The key to multilingual ca- pabilities in large language models,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:53.628004Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:41.060069Z digest=sha256:81abafa78907b3a807cf63300a04c7b380921a3ae8d684e06b405dd1bf143c3c

Observation 41ccb67a-b407-4d0d-a330-a5ceba50c27a · outbound

This paper cites Unveiling A Core Linguistic Region in Large Language Models.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Unveiling A Core Linguistic Region in Large Language Models

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:41.154385Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:41.154385Z digest=sha256:163c1571c1b2537726709754f7e81faa7b79fa7b2cb43bb2c57d272b5d2fe430

Observation b5a452b7-0514-4390-a217-1cc74004e77b · outbound

This paper cites Do large language models latently perform multi-hop reasoning?.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Do large language models latently perform multi-hop reasoning?

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:53.495179Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:41.278719Z digest=sha256:8f9cbf893ddef4dcbe115d35415d10319764468f17fd6d9093c206087aa7d67b

Observation 80808549-20ef-42be-93a5-7f56642fa035 · outbound

This paper cites Hopping too late: Exploring the limitations of large language models on multi-hop queries,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Hopping too late: Exploring the limitations of large language models on multi-hop queries,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:53.328622Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:41.344013Z digest=sha256:d46e7b48cf37fbbe93fc97d0554c4985456d8f14d027f8b78da24a733dd42192

Observation 34373ead-3978-4a9a-a669-ff175d7c1a59 · outbound

This paper cites Back Attention: Understanding and Enhancing Multi-Hop Reasoning in Large Language Models.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Back Attention: Understanding and Enhancing Multi-Hop Reasoning in Large Language Models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:41.444497Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:41.444497Z digest=sha256:2102e2430006e01224236b8144cdeade84951d9b0d3df7f69cd68a6d7b5af10e

Observation e3ab0f48-158b-4f3a-89ba-1a5ca2385c40 · outbound

This paper cites Knowledge neurons in pretrained transformers,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Knowledge neurons in pretrained transformers,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:53.207526Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:41.540789Z digest=sha256:5cb7d678c42922043b940fc4e9a8cdef3ecec628bbfa459726120d728b33d9ff

Observation 2d6b254a-74ab-48d4-b9b1-92c825e88c96 · outbound

This paper cites Neuron-level knowledge attribution in large language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Neuron-level knowledge attribution in large language models,

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:52.986466Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:41.604588Z digest=sha256:ea37f8ecf6c105e4f25afa09aae77d4c21ecc0585e5420790c46f61651b8e179

Observation 0cdcd27e-ab70-4947-b130-04fd06516c98 · outbound

This paper cites Listen and speak fairly: a study on semantic gender bias in speech integrated large language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Listen and speak fairly: a study on semantic gender bias in speech integrated large language models,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:52.768197Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:41.682261Z digest=sha256:b030b5f0194f56f45438b87cef3a1c2f636fbffb87bd976c384f64923cc3e6a6

Observation 430d8b40-28c3-485f-a683-4845b1a48d5a · outbound

This paper cites The Curse of Multi-Modalities: Evaluating Hallucinations of Large Multimodal Models across Language, Visual, and Audio.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models The Curse of Multi-Modalities: Evaluating Hallucinations of Large Multimodal Models across Language, Visual, and Audio

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:41.761053Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:41.761053Z digest=sha256:ecb8456706b3aa54ea8200bb744bc882541ff057d44c8034df0e3771ed4a1578

Observation fdc3dfa9-8676-4cf3-8fd8-b0ea56244600 · outbound

This paper cites Can large audio-language models truly hear? tackling hallucinations with multi-task assessment and stepwise audio reasoning,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Can large audio-language models truly hear? tackling hallucinations with multi-task assessment and stepwise audio reasoning,

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:52.597249Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:41.850501Z digest=sha256:847f0c76fa4457ddfb5944cf6811ec17f5cc2dd8daafe6b6b26cefe6b58e20bf

Observation 71985eb9-f25d-4fb9-973d-c94817a254f4 · outbound

This paper cites Interpreting GPT: the logit lens,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Interpreting GPT: the logit lens,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:52.405947Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:41.923742Z digest=sha256:be9a34e224e691363da71ccc867dafbc66b1990b6375a622bd3f9fd1aae287b0

Observation 7faaee5b-4393-464f-bafe-97049a2d0928 · outbound

This paper cites Transformer feed- forward layers build predictions by promoting concepts in the vocabulary space,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Transformer feed- forward layers build predictions by promoting concepts in the vocabulary space,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:52.248234Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:42.032988Z digest=sha256:42815e277c5ea124788fe9006a55108026b6e39bae57b415066e2e2ea8a4febc

Observation 5f52850f-a96f-4253-b79c-127c79882dc4 · outbound

This paper cites Jump to conclusions: Short-cutting transformers with linear transformations,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Jump to conclusions: Short-cutting transformers with linear transformations,

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:52.035359Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:42.170174Z digest=sha256:f0c2de72bb76ae29e344f14a2b9e0efaca59d0207015b428afe35016e85ed47a

Observation 11a12ac2-19ca-4bd8-92a9-80ff236f836d · outbound

This paper cites Eliciting Latent Predictions from Transformers with the Tuned Lens.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Eliciting Latent Predictions from Transformers with the Tuned Lens

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:42.267367Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:42.267367Z digest=sha256:ddb5839b10d08b3511192697aae7e28daba3e41525bc6c1ac02426146d8d3cd8

Observation a6d30e0a-e916-4e67-8afb-90d45e4d2926 · outbound

This paper cites Superb: Speech processing universal performance benchmark,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Superb: Speech processing universal performance benchmark,

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:51.805057Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:42.341114Z digest=sha256:d0839eeccecb04584a20320d6e6133d4afc2ba81fe244ed75b11bc135cef8de1

Observation 87c54f9d-7cc2-45bc-9464-4467e2c43df8 · outbound

This paper cites Superb-sg: Enhanced speech processing universal performance benchmark for semantic and generative capabilities,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Superb-sg: Enhanced speech processing universal performance benchmark for semantic and generative capabilities,

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:51.562454Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:42.439650Z digest=sha256:bc29d23860000f2c87dc0256451ae0757ca979bdd4acfd3ea73c45082f269e41

Observation f9d3a312-8c5f-42a5-95bb-23778ae1dfe8 · outbound

This paper cites Hear: Holistic evaluation of audio representations,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Hear: Holistic evaluation of audio representations,

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:51.327559Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:42.535596Z digest=sha256:d8dac2a3766334cf0af341bc20e79621b4804bc5fa325730e64d38fff185ad3b

Observation 533e4995-5bb6-4683-ae37-237e9e1525f2 · outbound

This paper cites Marble: Music audio representation benchmark for universal evaluation,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Marble: Music audio representation benchmark for universal evaluation,

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:51.103447Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:42.630486Z digest=sha256:fac447865cb4fa206f5944891b248f32245c3d1eef67f706de7729d71445597c

Observation 20771945-269a-49d7-b377-95965a6790f5 · outbound

This paper cites The zero resource speech benchmark 2021: Metrics and baselines for unsupervised spoken lan- guage modeling,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models The zero resource speech benchmark 2021: Metrics and baselines for unsupervised spoken lan- guage modeling,

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:50.920026Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:42.742459Z digest=sha256:f2c67d72463af287634c110a4977003d9ad6bafef2911a1723990105ad54bdb8

Observation c17ec7f1-7408-4b10-a54a-17411905ff03 · outbound

This paper cites Zero re- source code-switched speech benchmark using speech utterance pairs for multiple spoken languages,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Zero re- source code-switched speech benchmark using speech utterance pairs for multiple spoken languages,

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:50.713540Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:42.847809Z digest=sha256:6f8861e89f326449b44d96e9c14abed6c1fc9dffc30427ce75fb82f0999c0e38

Observation 88ec8539-a0f7-4678-8022-20978f78219e · outbound

This paper cites Yang, K.-P.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Yang, K.-P

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:50.480191Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:42.973675Z digest=sha256:a295a6b79bd9d84280df9d92346755b2f011259075d1a22c01f872a828cf90ba

Observation 999177de-285d-4738-92ef-8c66b8a859c5 · outbound

This paper cites Ml-superb: Multi- lingual speech universal performance benchmark,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Ml-superb: Multi- lingual speech universal performance benchmark,

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:50.304813Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:43.081636Z digest=sha256:14f982c46be9139b5898d03c7c71b4fa3c79b16ce9583d77c8e511005c113818

Observation 7a5f1b1c-f4c1-4dce-900b-24c38ee814aa · outbound

This paper cites Hubert: Self-supervised speech representation learning by masked prediction of hidden units,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Hubert: Self-supervised speech representation learning by masked prediction of hidden units,

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:43.163518Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:43.163518Z digest=sha256:5197b412f9c8ce8954c93d9bea8adb24858e094ac88d1c7dcd370642eb1cdd44

Observation d6b02991-a84d-41ba-ae29-a98470367764 · outbound

This paper cites Distilhubert: Speech represen- tation learning by layer-wise distillation of hidden-unit bert,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Distilhubert: Speech represen- tation learning by layer-wise distillation of hidden-unit bert,

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:50.116539Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:43.282638Z digest=sha256:45516421278f4e271e722941a32eda7c082d7fa1d90ae75fb2e9b4db385b8524

Observation d23963c7-5910-4dbc-a95b-18c54acff6b6 · outbound

This paper cites wav2vec: Unsu- pervised pre-training for speech recognition,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models wav2vec: Unsu- pervised pre-training for speech recognition,

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:49.884518Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:43.363926Z digest=sha256:3c739251b4bb5ab5ad5a704ce7dc413890027925e87ce37e0b5ccf04068f3f2e

Observation 13472697-22eb-4688-ac30-eb7430aa469b · outbound

This paper cites wav2vec 2.0: A framework for self-supervised learning of speech representations,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models wav2vec 2.0: A framework for self-supervised learning of speech representations,

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:43.464970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:43.464970Z digest=sha256:935166f6df57b014e4f3b0188f122942f1be08a9322f902088506d64007b882d

Observation 590f5ae6-61a5-47bc-8428-42360c4161cd · outbound

This paper cites Un- supervised cross-lingual representation learning for speech recognition,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Un- supervised cross-lingual representation learning for speech recognition,

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:49.629438Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:43.615965Z digest=sha256:673c1b86d122f8ebe8ad8fa574fa7df699e9f23cdd74acbf63aff31273b463e6

Observation 2dc9822f-7971-4ae7-bf39-39f123942272 · outbound

This paper cites Layer-wise analysis of a self-supervised speech representation model,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Layer-wise analysis of a self-supervised speech representation model,

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:43.713167Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:43.713167Z digest=sha256:01a2f955901612496985566a0842aa55eadca499053fd6f7f45cf176f303dd2f

Observation 358c2750-2aac-4303-a883-fe4b5d4e8a6d · outbound

This paper cites Comparative layer-wise analysis of self-supervised speech models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Comparative layer-wise analysis of self-supervised speech models,

Reference 51

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:49.412394Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:43.802905Z digest=sha256:4df8b827229ff365227e91d58a2d9b86769ffb2e21110b149ee1bbef1b95a9cc

Observation fd57bbe1-a919-4430-8d50-c1ac6b5de80a · outbound

This paper cites What do self- supervised speech models know about words?.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models What do self- supervised speech models know about words?

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:43.922682Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:43.922682Z digest=sha256:270116b0167d0f74a2b79f722cdb364a4b9d06071a8c75b6b889cbf6df12cb85

Observation e4d48e92-c3e0-4404-81d0-f62e8e5d66d7 · outbound

This paper cites Self-supervised speech representations are more phonetic than semantic,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Self-supervised speech representations are more phonetic than semantic,

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:49.151047Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:44.021653Z digest=sha256:bff0dc8b267de4b20fd0e18ae33d9af6ddcea7dc5ede574a0435dbbe21e44f27

Observation 38d0acc9-7ce4-43ff-a5e1-66cd90910740 · outbound

This paper cites Property neurons in self-supervised speech transformers,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Property neurons in self-supervised speech transformers,

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:48.904036Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:44.138736Z digest=sha256:f5725d6841b732e87f5830b93b4c6f85e2b062c7226c208888d6c1b0eadb2c69

Observation 2f9ac762-9a08-4a90-a56c-a7fa6e953d72 · outbound

This paper cites And: Audio network dissection for interpreting deep acoustic models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models And: Audio network dissection for interpreting deep acoustic models,

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:48.686867Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:44.271750Z digest=sha256:025eb51ada02e4b4c0f96e73fd78e3f91dfb14efa1a79aedfefee73754d0076a

Observation 11f6f6d0-df7a-49e2-92c0-68c998ce1662 · outbound

This paper cites Do prompts really prompt? exploring the prompt understanding capability of whisper,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Do prompts really prompt? exploring the prompt understanding capability of whisper,

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:48.464754Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:44.360094Z digest=sha256:95daacc3533be4c3c227bca83bce6ae198107f14bb63869c837f6b3f6fdf458d

Observation 85a15553-dbcb-4263-be7f-fd6d326401ba · outbound

This paper cites Hey asr system! why aren’t you more inclusive? automatic speech recognition systems’ bias and proposed bias mitigation techniques. a literature review,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Hey asr system! why aren’t you more inclusive? automatic speech recognition systems’ bias and proposed bias mitigation techniques. a literature review,

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:48.211091Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:44.446769Z digest=sha256:f6d2c96bb518ae0723a5b25709d377f65802272153a63e22569f0cb75b076243

Observation 83b29e76-ecc0-4b82-8780-90d542a34aa2 · outbound

This paper cites Emo-bias: A large scale evaluation of social bias on speech emotion recognition,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Emo-bias: A large scale evaluation of social bias on speech emotion recognition,

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:48.035026Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:44.544838Z digest=sha256:1d427b97ba5d18346ca25b4f48018acb42de1c312437a115d2fc51b27dbec31f

Observation bef6882b-a9e1-47a8-8fac-fa1f6f7d6a20 · outbound

This paper cites Attention is not only a weight: Analyzing transformers with vector norms,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Attention is not only a weight: Analyzing transformers with vector norms,

Reference 59

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:47.828288Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:44.632292Z digest=sha256:248a38a2bab4f45926b3d29d2c5d9e9eaf6c472bc117fe23621c6ef4af41fd96

Observation 216ff809-949b-444b-9ec9-f362e8d5e61f · outbound

This paper cites An investigation of neuron activation as a unified lens to explain chain-of-thought eliciting arithmetic reasoning of llms,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models An investigation of neuron activation as a unified lens to explain chain-of-thought eliciting arithmetic reasoning of llms,

Reference 60

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:47.602048Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:44.708581Z digest=sha256:9bf60f0fda5c04d099d662a17f2b0d35d6fda0ac6c562782cd0fc76715e7ceeb

Observation 60238b45-8fe9-4896-9f52-5a5bacfbaac4 · outbound

This paper cites Understanding and enhancing safety mechanisms of LLMs via safety-specific neuron,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Understanding and enhancing safety mechanisms of LLMs via safety-specific neuron,

Reference 61

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:47.389645Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:44.785659Z digest=sha256:be137f6bfcdf75e36ab1aadc0dc5a06d2c2512b34f50188f2c736ae7e3d3d8fe

Observation a2f09161-2083-467f-8363-d8b0d72f539c · outbound

This paper cites Patchscopes: a unifying framework for inspecting hidden representa- tions of language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Patchscopes: a unifying framework for inspecting hidden representa- tions of language models,

Reference 62

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:47.186010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:44.872331Z digest=sha256:4628bea3e61d0ae6fc4efa2ca08a783e811b0339b88c901ec3411b945ec1f96e

Observation 8cb66489-fe01-4ea8-bfdd-537e2eb355be · outbound

This paper cites Probing classifiers: Promises, shortcomings, and ad- vances,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Probing classifiers: Promises, shortcomings, and ad- vances,

Reference 63

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:47.054969Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:44.980870Z digest=sha256:a706f3d7982873fce1999464c47897270930302a0fd5164ef4a9495b0c196655

Observation 9d3fb428-92da-47fb-8450-ab53a9eed2e2 · outbound

This paper cites Locating and editing factual associations in gpt,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Locating and editing factual associations in gpt,

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:45.070032Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:45.070032Z digest=sha256:4b54a4cd4f050632aeaaccea741806486ad8c36954ca5d928a3350c99c0d9be5

Observation efc027ab-9f73-4900-8149-fb0eda0c8a69 · outbound

This paper cites Language models implement simple word2vec-style vector arithmetic,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Language models implement simple word2vec-style vector arithmetic,

Reference 65

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:46.923791Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:45.155817Z digest=sha256:72dfbbaf81abac5b66f1ba8af2af6aa223eca23cd8de2d4adc581abb04d1d1f3

Observation 6b0bba89-a4fe-4ea7-92a7-2662a66a5fc1 · outbound

This paper cites Dissecting recall of factual associations in auto-regressive language models,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Dissecting recall of factual associations in auto-regressive language models,

Reference 66

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:46.707136Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:45.247861Z digest=sha256:c65ed13092e6f89b8c006792ed34717d7b7994360eec7c082b3f41f08d0f8886

Observation dc29f272-fae9-4ad9-896c-ba6620f2bc85 · outbound

This paper cites LogitLens4LLMs: Extending Logit Lens Analysis to Modern Large Language Models.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models LogitLens4LLMs: Extending Logit Lens Analysis to Modern Large Language Models

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:45.356667Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:45.356667Z digest=sha256:6d8c8f7decb3310254ab22ca247e41333a3775c86f5b5038341d56c75e064e2d

Observation 3de112a3-c617-426c-9ba7-d876bd1c4740 · outbound

This paper cites Interpreting and editing vision-language representations to mitigate hallucinations,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Interpreting and editing vision-language representations to mitigate hallucinations,

Reference 68

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:46.518839Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:45.458884Z digest=sha256:e4b9add2b4d4139a62dd4b8222f4b1a9e2dca3b561872fc83504d5e470276f40

Observation 29447404-6719-40ec-9937-d267fb413939 · outbound

This paper cites Towards Interpreting Visual Information Processing in Vision-Language Models.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Towards Interpreting Visual Information Processing in Vision-Language Models

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-07T10:28:45.549978Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:28:45.549978Z digest=sha256:942d975343cf1f49e3183b0532c027d1b5f7de62ae275f5403e5d234b51939d9

Observation d82bdc62-f328-427b-984a-1ab6dc9fc555 · outbound

This paper cites Mmneuron: Discovering neuron-level domain-specific interpretation in multimodal large language model,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Mmneuron: Discovering neuron-level domain-specific interpretation in multimodal large language model,

Reference 70

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:46.335269Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:45.660126Z digest=sha256:4e4d6ec965c9d808d3d2a7ce65073d4eb63e0c24f4f1ef273a6d4991ba6d2190

Observation 311eee3a-54e4-4a15-b4ca-19732ab683c8 · outbound

This paper cites Measuring massive multitask language understanding,.

AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models Measuring massive multitask language understanding,

Reference 71

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T10:28:46.132024Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-07T10:28:45.760195Z digest=sha256:abdf23ffd984b98d7fd1bfa432e3bb816a89ae06e4dae4b30d0b47eb804501b8

Pith citing papers

Observation 4b4c16e3-ffa9-4279-b092-f29e7075d693 · inbound

Do Audio-Visual Large Language Models Really See and Hear? cites this paper.

Do Audio-Visual Large Language Models Really See and Hear? AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models

Reference 59

Resolution
verified exact
arxiv_id, observed 2026-05-13T20:58:15.807264Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-13T20:56:19.815569Z digest=sha256:a6b436aca7b2d37a0e599924216805cbaefe5b4754d8c0a2e1bb693d1a045e76

Observation 8c896b53-acc0-4529-9cc0-d8c7d500e765 · inbound

All That Glitters Is Not Audio: Rethinking Text Priors and Audio Reliance in Audio-Language Evaluation cites this paper.

All That Glitters Is Not Audio: Rethinking Text Priors and Audio Reliance in Audio-Language Evaluation AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-05-11T23:16:36.162279Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-07T17:39:38.234052Z digest=sha256:b9198ece916d66d11554405f5de9b08c807cfe61e07286e5fb387475cc35f3f8

Observation 81c5aee3-dbe6-4897-8bb8-a06c1a164750 · inbound

Probing Low-Level Acoustic Attribute Encoding in CLAP Audio Embeddings cites this paper.

Probing Low-Level Acoustic Attribute Encoding in CLAP Audio Embeddings AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models

Reference 20

Resolution
unresolved
no resolver link, observed 2026-07-11T23:50:12.369547Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-11T23:50:12.369547Z digest=sha256:91f367e6ada808d3107d4c13ae9190fc1a953c15b8e89f8ee55bf0cc737930bc

Observation 9b8cb20c-c684-4561-851e-9dbd9768238f · inbound

Separating Decision-Rule Misalignment from Readout-Coverage Limitations in Speech Language Models cites this paper.

Separating Decision-Rule Misalignment from Readout-Coverage Limitations in Speech Language Models AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-10T04:32:31.824223Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T04:32:31.824223Z digest=sha256:d954f39355b651e038081a139394777bbfaefb896eb934ad05bcbf8f188caf4d

Observation c046baf5-8646-49bd-a110-8e7a730758c2 · inbound

Multilingual Emotion Neurons in Large Audio-Language Models cites this paper.

Multilingual Emotion Neurons in Large Audio-Language Models AudioLens: A Closer Look at Auditory Attribute Perception of Large Audio-Language Models

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-14T04:29:37.954753Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-14T04:29:37.954753Z digest=sha256:45bd26bef5ec41225ad38f962ac50c156c532c668e04ff5a358147dc07414480