Pith. sign in

Paper Citation Record · LEDGER

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions

As of 22 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2607.17812.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2607.17812 v1

Coverage vector

measured 25 of 25 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-01T16:57:11.668450Z

measured 25 of 25 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-21T06:32:19.484+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

25 of 25 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved25
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation fb43b3f9-195f-4b6b-a7bf-c6d39dc0b634 · outbound

This paper cites Listen, think, and understand,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Listen, think, and understand,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:09.057511Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:09.057511Z digest=sha256:a1ce056b62aeda703bfd667a9bf38801ff72adcb881fca2382886d9952f464a3

Observation 393ac4e8-c1c1-423d-a387-d8e2e1227fa4 · outbound

This paper cites video-salmonn: Speech-enhanced audio-visual large language models,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions video-salmonn: Speech-enhanced audio-visual large language models,

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:09.232035Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:09.232035Z digest=sha256:40101e4563da6f61cff62e398c1f56341274fb0df183f5a911220f9c940e3b2b

Observation 60c21802-fd7d-471d-a0d7-4bf5388a1493 · outbound

This paper cites GAMA: A large audio-language model with advanced audio understanding and complex reasoning abilities,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions GAMA: A large audio-language model with advanced audio understanding and complex reasoning abilities,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:09.546080Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:09.546080Z digest=sha256:dbfec39ae16eb35d83b5519493c7d135cb05d4a25edaae484e3a92bcbbddaf36

Observation f9a26cce-429a-41b9-bf75-bb2879ed9087 · outbound

This paper cites Qwen3-Omni Technical Report.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Qwen3-Omni Technical Report

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:09.654669Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:09.654669Z digest=sha256:95818aae105324cd4c50f47a5b59f1febc1952f27ddd4461456b9d941be59c1d

Observation 0419729f-72c5-4f6c-a313-98f22573063b · outbound

This paper cites Kimi-Audio Technical Report.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Kimi-Audio Technical Report

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:09.840855Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:09.840855Z digest=sha256:b6565d7349877747d16665dc417618e093108a726fd64ec8fc298ff1283d0540

Observation 3e385f4e-6eb8-4910-830a-34a5d77b6b0d · outbound

This paper cites Audio flamingo 3: Advancing audio intelligence with fully open large audio language models,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Audio flamingo 3: Advancing audio intelligence with fully open large audio language models,

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:09.961025Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:09.961025Z digest=sha256:6a0da67bfef3e1202eb6fab135ed383048b00a13c1469fea6bc56b9a702a27f5

Observation dba9b04a-a78b-4892-ad20-cb005b24f8ea · outbound

This paper cites Dynamic-superb: Towards a dynamic, collaborative, and comprehensive instruction-tuning benchmark for speech,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Dynamic-superb: Towards a dynamic, collaborative, and comprehensive instruction-tuning benchmark for speech,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:10.257358Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:10.257358Z digest=sha256:12de9f6e3181d8a98598a7f300ebd075f8e6db5b22c9695b68922a12f12f5f2f

Observation 6857c409-0c0f-4d13-bdb6-481f409a1da4 · outbound

This paper cites Air-bench: Benchmarking large audio-language models via generative comprehension,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Air-bench: Benchmarking large audio-language models via generative comprehension,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:10.359096Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:10.359096Z digest=sha256:e293268cf9edf67027c092cb99f9fb80b965a3586d717486329b657fa91097a1

Observation 8f2031ea-6c8c-4b43-a9ff-d089d0688335 · outbound

This paper cites Audiobench: A universal benchmark for audio large language models,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Audiobench: A universal benchmark for audio large language models,

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:10.402494Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:10.402494Z digest=sha256:01c40b91a012c538d8cc0b6263e6d6a00d31365c86c6b84b239dd1846bcbb2a0

Observation 175f8ed8-c8f0-44af-9cc6-a55ed03ee30b · outbound

This paper cites Dynamic-superb phase-2: A collaboratively expanding benchmark for measuring the capabilities of spoken language models with 180 tasks,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Dynamic-superb phase-2: A collaboratively expanding benchmark for measuring the capabilities of spoken language models with 180 tasks,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:10.415839Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:10.415839Z digest=sha256:42fad4360b8feaaede2aa5613d56ecb685c8f534e86d027d131b5af9f3a96837

Observation 051d9b74-2257-4828-b60a-3d163d68e604 · outbound

This paper cites MMAU: A massive multi- task audio understanding and reasoning benchmark,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions MMAU: A massive multi- task audio understanding and reasoning benchmark,

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:10.476880Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:10.476880Z digest=sha256:f6ae0724acc9f1471b1ec90e02dc761094b6bb1080ac85bd42ce73850052bc7e

Observation d5df37c1-9e15-41a2-a577-ca0cea4b0747 · outbound

This paper cites Mmar: A challenging benchmark for deep reasoning in speech, audio, music, and their mix,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Mmar: A challenging benchmark for deep reasoning in speech, audio, music, and their mix,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:10.558944Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:10.558944Z digest=sha256:e0e2c6139ee52daec6d687a81fee5e0f4e9417acc145c8cf6eeedf0b1a341fa5

Observation 2339e3eb-75d8-48dc-92b0-902fc4147dd4 · outbound

This paper cites SAKURA: On the Multi- hop Reasoning of Large Audio-Language Models Based on Speech and Audio Information,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions SAKURA: On the Multi- hop Reasoning of Large Audio-Language Models Based on Speech and Audio Information,

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:10.671527Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:10.671527Z digest=sha256:914bae9dfed68c03abd4fd4d9bc7f4ee281358ec17e8c522e29f063c2cc64d39

Observation 193549c3-989e-46d2-b4fc-63ef0f442d69 · outbound

This paper cites MMSU: A Massive Multi-task Spoken Language Understanding and Reasoning Benchmark.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions MMSU: A Massive Multi-task Spoken Language Understanding and Reasoning Benchmark

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:10.773561Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:10.773561Z digest=sha256:f1f42ddf4995fc0d13a16ca846d0a1d4f7797dee27497481751a128b5a99f691

Observation f1cd8a41-ce55-4f94-8561-e12ce6727312 · outbound

This paper cites Mmau-pro: A challenging and comprehensive benchmark for holistic evaluation of audio general intelligence,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Mmau-pro: A challenging and comprehensive benchmark for holistic evaluation of audio general intelligence,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:10.911529Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:10.911529Z digest=sha256:117d6a160e9180455cbde35c6c18c69eb187d42ba2debf75ee0d05874b3371f4

Observation 793ac652-4e23-4fc1-a7e9-c145fb195047 · outbound

This paper cites The torgo database of acoustic and articulatory speech from speakers with dysarthria,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions The torgo database of acoustic and articulatory speech from speakers with dysarthria,

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:10.969687Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:10.969687Z digest=sha256:de0c220454ea69404116018c9fea1b684b59a3534e33a6a8ff7485d149f4ce9f

Observation 71d50e5a-808b-4942-b232-ae969f19b093 · outbound

This paper cites Dysarthric speech database for universal access research.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Dysarthric speech database for universal access research

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:11.025440Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:11.025440Z digest=sha256:f516ad40a0c7578b72a14707d1eb6dd48c99317832aed9827a14def3325f14dc

Observation d41c04b3-9982-42b5-84da-2e50ea5883cf · outbound

This paper cites GlobeAudio: A Multilingual Multicultural Benchmark for Naturalistic Evaluation of Large Audio-Language Models.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions GlobeAudio: A Multilingual Multicultural Benchmark for Naturalistic Evaluation of Large Audio-Language Models

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:11.090454Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:11.090454Z digest=sha256:7bc42b69ac0b79bf5bde7fcb4e30b68f142edade61809c1b02c51469fece7e95

Observation 11dbac94-4904-40d3-acf6-50a735a500ab · outbound

This paper cites Fleurs-slu: A massively multilingual benchmark for spoken language understanding,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Fleurs-slu: A massively multilingual benchmark for spoken language understanding,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:11.222090Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:11.222090Z digest=sha256:1c36c5aa75d3e87be4897cdfc7a0502ddab1c16046ee8e41212ca62b47ae8f87

Observation ffcd3afb-a461-4cd5-a34a-cda8081f76f7 · outbound

This paper cites Iberobench: A benchmark for llm evaluation in iberian languages,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Iberobench: A benchmark for llm evaluation in iberian languages,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:11.301886Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:11.301886Z digest=sha256:452c3463b9ecb6b6f204d5e1edf720cc2b7e7e7be5f3a9ea8129d4e65a059b7f

Observation 475bb423-9c3c-4c9b-aff9-f39783c5f9f6 · outbound

This paper cites When Audio-Language Models Fail to Leverage Multimodal Context for Dysarthric Speech Recognition.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions When Audio-Language Models Fail to Leverage Multimodal Context for Dysarthric Speech Recognition

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:11.349967Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:11.349967Z digest=sha256:33e78c296181886ee12ea9cc8a4b181cef4234d7169f747b54110bdc4c2f9950

Observation 9cc5e804-cf13-49d7-a5bf-9a56f198001d · outbound

This paper cites OmniVoice: Towards Omnilingual Zero-Shot Text-to-Speech with Diffusion Language Models.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions OmniVoice: Towards Omnilingual Zero-Shot Text-to-Speech with Diffusion Language Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:11.412058Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:11.412058Z digest=sha256:77f5e7ddd0688f84cfc6b5b7220bec1415ae43910561932db3ddd4ba1dba4c46

Observation 9ccec7c0-c125-411f-809c-446281cc4a93 · outbound

This paper cites Voxtral.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Voxtral

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:11.564423Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:11.564423Z digest=sha256:0b918e3bc68711a63182abda400994cf63a46a9814881f2676b7e07f0c19ab19

Observation c4382f2f-1055-420e-bb10-d92b3463db70 · outbound

This paper cites Robust speech recognition via large-scale weak super- vision,.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Robust speech recognition via large-scale weak super- vision,

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:11.619856Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:11.619856Z digest=sha256:2f4688593f3fa959ffdb18b11cc06bd30f7b9ef3043a3a17496721550d2e108f

Observation b1ec11eb-0e8b-409f-8c0d-7ea12fb291bb · outbound

This paper cites Qwen3 Technical Report.

ESCUCHA: A Spanish Speech Benchmark for Heterogeneous Acoustic Conditions Qwen3 Technical Report

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-01T16:57:11.668450Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T16:57:11.668450Z digest=sha256:f468326049e69f718a9518607733fa0916ce7d6cb9679c4435f65a1d6cf3af1d

Pith citing papers

No inbound Pith citation observations are available.