Pith. sign in

Paper Citation Record · LEDGER

AudioBench: A Universal Benchmark for Audio Large Language Models

As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 25 inbound Pith citation observations for arXiv:2406.16020.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2406.16020 v5

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 25 of 25 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-23T06:30:58.430688+00:00

measured 25 of 25 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-15T21:19:59.146352Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-05T02:28:24.338817Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

4
pith, observed 2026-08-05T02:28:24.338817Z

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation b1a9b804-2953-4666-8849-742c3f602ebf · inbound

VoiceBench: Benchmarking LLM-Based Voice Assistants cites this paper.

VoiceBench: Benchmarking LLM-Based Voice Assistants AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 99

Resolution
verified exact
arxiv_id, observed 2026-05-17T00:50:14.018476Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-05-17T00:50:13.841689Z digest=sha256:e9c6e8895c311e4ab8fd23243fb1766a502338c9e0c24180a220967b4f04c13d

Observation b6f8fe61-ed50-4ee8-a7db-66ffc4118949 · inbound

WavChat: A Survey of Spoken Dialogue Models cites this paper.

WavChat: A Survey of Spoken Dialogue Models AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 206

Resolution
unresolved
no resolver link, observed 2026-08-12T20:13:58.086886Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T20:13:58.086886Z digest=sha256:5b5be982c313d207f618edfba9cc08e8a7b2baae3baa7a3c3ebcb23139d58dd5

Observation 4d9f8987-783e-46ff-897a-f2515da84d84 · inbound

MERaLiON-AudioLLM: Bridging Audio and Language with Large Language Models cites this paper.

MERaLiON-AudioLLM: Bridging Audio and Language with Large Language Models AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-11T16:46:13.336533Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T16:46:13.336533Z digest=sha256:d7bb099604079ec837dcee01e3c09eaff5a32263ed76d9c1ec45f03766f0992b

Observation 6b5f935f-5e54-4c99-b575-ea8ef3f15a60 · inbound

SpeechPrune: Context-aware Token Pruning for Speech Information Retrieval cites this paper.

SpeechPrune: Context-aware Token Pruning for Speech Information Retrieval AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-11T14:27:27.254326Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:27:27.254326Z digest=sha256:226fc9bbd3d9401554ec5dd2bd848026f8c7af4aa6dbdb1e83f0353287746850

Observation b22e8a33-f036-4fe4-bb3f-4b9bd2faa5a3 · inbound

Advancing Singlish Understanding: Bridging the Gap with Datasets and Multimodal Models cites this paper.

Advancing Singlish Understanding: Bridging the Gap with Datasets and Multimodal Models AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-10T22:40:25.563518Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-10T22:40:25.563518Z digest=sha256:95bd2afcf3575403476c226364f4bd00e88ea8aebf1f172bc70dd9489a08af54

Observation e87f1a87-d1f4-4327-82aa-c7ad876f3b05 · inbound

VoxEval: Benchmarking the Knowledge Understanding Capabilities of End-to-End Spoken Language Models cites this paper.

VoxEval: Benchmarking the Knowledge Understanding Capabilities of End-to-End Spoken Language Models AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-10T21:24:18.256256Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-10T21:24:18.256256Z digest=sha256:5f2defd48c57f007064962d8828bd169f8385e8faaf59750e5fa928036455118

Observation ac52300f-da3f-4ae7-a13e-246550a4259a · inbound

Audio-Language Models for Audio-Centric Tasks: A Systematic Survey cites this paper.

Audio-Language Models for Audio-Centric Tasks: A Systematic Survey AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 160

Resolution
unresolved
no resolver link, observed 2026-08-10T14:36:19.925145Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T14:36:19.925145Z digest=sha256:4859871bf03a9ffedb591120e88d7eaedfe2c3ab651c6ea5b713ed0989e1f2ce

Observation cbe61ebe-1ea8-4841-a900-d20a5fa16e6f · inbound

Audio Large Language Models Can Be Descriptive Speech Quality Evaluators cites this paper.

Audio Large Language Models Can Be Descriptive Speech Quality Evaluators AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 2005

Resolution
unresolved
no resolver link, observed 2026-08-10T12:30:52.122984Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T12:30:52.122984Z digest=sha256:62a8d196a79cc0e0dbe0b4eb8627372048dfcbc4801542bf9c4ad117099f3a8c

Observation 6d0e6881-6005-4f12-aecb-dac4844dd551 · inbound

Do Audio-Visual Segmentation Models Truly Segment Sounding Objects? cites this paper.

Do Audio-Visual Segmentation Models Truly Segment Sounding Objects? AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-09T19:24:20.433964Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T19:24:20.433964Z digest=sha256:1a420ee1ed81100bd29a39b9a4b7069954f2313f1bb63343b4da0f646b92bf8a

Observation 2d19c0f1-da05-420b-90a0-6e611388aff7 · inbound

On The Landscape of Spoken Language Models: A Comprehensive Survey cites this paper.

On The Landscape of Spoken Language Models: A Comprehensive Survey AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 45

Resolution
verified exact
arxiv_id, observed 2026-05-22T20:45:08.211361Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-22T20:44:57.476464Z digest=sha256:69d75c7191bb57c6e342e90ecc3ff17bf2c6bb9c96f147f20534329bf53ff309

Observation efca0a97-0f39-4ac6-ad02-50bf9acf02c3 · inbound

Benchmarking and Confidence Evaluation of LALMs For Temporal Reasoning cites this paper.

Benchmarking and Confidence Evaluation of LALMs For Temporal Reasoning AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-15T20:23:49.288989Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:23:49.288989Z digest=sha256:835f69adeae4611eb1265c23b2a5b84070f16c077d82c40e4011789a4787e8a1

Observation 20831a34-18e7-4c68-9a0e-3efe59b7320f · inbound

ALAS: An Automatic Latent Alignment Score for Audio Language Models cites this paper.

ALAS: An Automatic Latent Alignment Score for Audio Language Models AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:23.503947Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:07:23.503947Z digest=sha256:a5db99e7d958c356ff2f2304c9094e32550398869a6cf90ae53b723cb6db0fa9

Observation 81f2ac99-dae6-4374-ac32-28a3bdc6c38e · inbound

Multimodal Financial Foundation Models (MFFMs): Progress, Prospects, and Challenges cites this paper.

Multimodal Financial Foundation Models (MFFMs): Progress, Prospects, and Challenges AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-15T21:19:59.146352Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T21:19:59.146352Z digest=sha256:4aa6040293e0abd7a65fb034a6f22e65419f857a2ab73d4f9def9d9e98d148a2

Observation 29ce5b87-dae4-464e-bda0-2ea07661c841 · inbound

Breaking the Barriers of Text-Hungry and Audio-Deficient AI cites this paper.

Breaking the Barriers of Text-Hungry and Audio-Deficient AI AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 138

Resolution
unresolved
no resolver link, observed 2026-08-07T11:28:59.437281Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:28:59.437281Z digest=sha256:4d75dc21445b766da542c1d3dec860ea0e890143c2f752faa57e45bdda088791

Observation 0db694d5-841a-41cf-99e1-1c9efe1a8c85 · inbound

SOVA-Bench: Benchmarking the Speech Conversation Ability for LLM-based Voice Assistant cites this paper.

SOVA-Bench: Benchmarking the Speech Conversation Ability for LLM-based Voice Assistant AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T11:26:23.203188Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:26:23.203188Z digest=sha256:298a6065a60986cd6f5070bc26670d39c67f3ba83d2aa0e6adbcd5829e91d76e

Observation 6512d42e-079e-4ed9-8525-b66be04faeb0 · inbound

CMI-Bench: A Comprehensive Benchmark for Evaluating Music Instruction Following cites this paper.

CMI-Bench: A Comprehensive Benchmark for Evaluating Music Instruction Following AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T00:59:48.715523Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:59:48.715523Z digest=sha256:52e9287d7972b53c6115c47b5536e4e3b27457f54c7215e1a8be0ff927746398

Observation 68ba51d8-c7cb-41db-bfb0-5262436c9773 · inbound

Zero-Shot Cognitive Impairment Detection from Speech Using AudioLLM cites this paper.

Zero-Shot Cognitive Impairment Detection from Speech Using AudioLLM AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-06T23:41:49.687916Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:41:49.687916Z digest=sha256:5c695f2faa5788bd687705f9329f74f074d62394926892f2ba463ce42f28f1aa

Observation c0e91432-1f42-4e51-96d7-0148ee36ad85 · inbound

XModBench: Benchmarking Cross-Modal Capabilities and Consistency in Omni-Language Models cites this paper.

XModBench: Benchmarking Cross-Modal Capabilities and Consistency in Omni-Language Models AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 20

Resolution
verified exact
arxiv_id, observed 2026-05-18T05:45:56.145885Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-18T05:45:07.700571Z digest=sha256:de8409f615ce8d3ae8fb71eaea80aa2d4a9b3e89f3e374968bfce360d4b66a3a

Observation 3d039abb-ea5e-429e-ae52-6d05891267e9 · inbound

All That Glitters Is Not Audio: Rethinking Text Priors and Audio Reliance in Audio-Language Evaluation cites this paper.

All That Glitters Is Not Audio: Rethinking Text Priors and Audio Reliance in Audio-Language Evaluation AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 33

Resolution
verified exact
arxiv_id, observed 2026-05-11T23:16:36.090825Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-07T17:39:38.234052Z digest=sha256:d4d60b9843bb7a5c5121610fe25a6eaeb4ab391fb70e1c0ea7a004786f3e7ec0

Observation 8c1f157e-598f-42d7-b795-c58e8df79f59 · inbound

PitchBench: Measuring Pitch Hearing in Audio-Language Models cites this paper.

PitchBench: Measuring Pitch Hearing in Audio-Language Models AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 3

Resolution
metadata mismatch
arxiv_id, observed 2026-06-29T22:44:02.190822Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-06-29T21:05:59.172850Z digest=sha256:91adecaa31dbc7bd7883de20b07a730fdbce81b21a9f3c909a9390a1004647f2

Observation bf6034b7-fcef-4acd-9d12-1857c9035139 · inbound

GlobeAudio: A Multilingual Multicultural Benchmark for Naturalistic Evaluation of Large Audio-Language Models cites this paper.

GlobeAudio: A Multilingual Multicultural Benchmark for Naturalistic Evaluation of Large Audio-Language Models AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 80

Resolution
verified exact
arxiv_id, observed 2026-07-02T21:17:24.545637Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-06-27T19:51:59.265579Z digest=sha256:279db81b4488337ad0286020de167fc6a19fc07acb4f2c1fd00c42090c826e96

Observation d81f3354-8dc4-4430-bafe-563f94290b38 · inbound

Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents cites this paper.

Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 179

Resolution
metadata mismatch
arxiv_id, observed 2026-06-30T22:15:05.582467Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-06-30T22:11:44.891731Z digest=sha256:9f53aa2f238ebd7a4b6f8d1b170c0f6df54ad54dbf32e9a368403e1a0ccd1395

Observation 8bff6c29-2a2f-4479-a0c5-a5c03635bc2e · inbound

REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing cites this paper.

REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 35

Resolution
verified exact
local_arxiv, observed 2026-07-07T14:53:55.866469Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-07-07T14:52:35.127533Z digest=sha256:065c38b8f747e23ae7053d300f359314c38c54b8a1f5ab9928a4fa8235c645f4

Observation 7b4e7f6d-8971-441e-87c9-1faa15b3e281 · inbound

REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing cites this paper.

REDDIT: Correcting Model-Generated Timestamp Drift in ASR without Forgetting via Replay-Based Distribution Editing AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-02T08:34:05.324498Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T08:34:05.324498Z digest=sha256:444b301e4e78f3a4e9a220929d045d9a069ae3bc5c786e52dafa74f4329b2cf0

Observation e5c0c47f-6b82-4139-b0e8-2c95d94bf9d0 · inbound

X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment cites this paper.

X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment AudioBench: A Universal Benchmark for Audio Large Language Models

Reference 79

Resolution
unresolved
no resolver link, observed 2026-08-01T07:12:15.816142Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-01T07:12:15.816142Z digest=sha256:45335f6a24359071f7eb0c86938a1aa109dae3c6bf054b06c73eda10d1bb1352