Pith. sign in

Paper Citation Record · LEDGER

The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2308.16884.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2308.16884 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 14 of 14 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 14 of 14 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-12T04:40:15.381678Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-23T06:25:27.841513Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 425af3ab-0780-4a70-9640-6849a3e6b153 · inbound

SailCompass: Towards Reproducible and Robust Evaluation for Southeast Asian Languages cites this paper.

SailCompass: Towards Reproducible and Robust Evaluation for Southeast Asian Languages The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-12T04:40:15.381678Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T04:40:15.381678Z digest=sha256:33e325adbd440cad557be3b3c82176ecaae04491f571a5390e28c980350cdfbc

Observation f14223e4-a499-4149-98f8-e35f2ed1763b · inbound

2M-BELEBELE: Highly Multilingual Speech and American Sign Language Comprehension Dataset cites this paper.

2M-BELEBELE: Highly Multilingual Speech and American Sign Language Comprehension Dataset The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-11T18:04:14.067390Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T18:04:14.067390Z digest=sha256:55a5cf30be35d45fbf023ecdf1be06a38922d0b61f27e8dc76e40728f5f23ec9

Observation 8148b7bd-ee9d-41f2-99fe-1c375ceb790b · inbound

BgGPT 1.0: Extending English-centric LLMs to other languages cites this paper.

BgGPT 1.0: Extending English-centric LLMs to other languages The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-11T15:35:55.266907Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T15:35:55.266907Z digest=sha256:eb700bd8ce30b631f0904e9cc927d50f9cf0063f8cb8498d2072a802f6a77766

Observation 148813b0-329c-4d88-a404-310f1eb67be9 · inbound

Qwen2.5 Technical Report cites this paper.

Qwen2.5 Technical Report The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

Reference 7

Resolution
verified exact
arxiv_id, observed 2026-05-23T06:25:27.844262Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-23T06:25:00.376073Z digest=sha256:c1ef08f68494a3d0afc891910901715f036218b349a32b3bfb3a8c02491aeca0

Observation 00d773f3-783b-40a6-9d5e-4c81af4e6cae · inbound

Fleurs-SLU: A Massively Multilingual Benchmark for Spoken Language Understanding cites this paper.

Fleurs-SLU: A Massively Multilingual Benchmark for Spoken Language Understanding The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-10T21:10:04.081234Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-10T21:10:04.081234Z digest=sha256:ae5f94d55667b7d3c751225a211b9a8d5910c65a3f21c596842aa228efc2991a

Observation ae538013-3ffe-476a-807a-4989d90432be · inbound

Qwen3 Technical Report cites this paper.

Qwen3 Technical Report The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

Reference 6

Resolution
verified exact
arxiv_id, observed 2026-05-09T06:35:28.449337Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-09T06:35:27.813995Z digest=sha256:d180fc7053f15994a178a0421e1bb2e0c1f8ad3a1aa0d235eb0f79b28afe8a7c

Observation 5d41d539-f2b3-404b-92c1-b6a48ae8adda · inbound

Cross-Lingual Optimization for Language Transfer in Large Language Models cites this paper.

Cross-Lingual Optimization for Language Transfer in Large Language Models The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T15:43:07.811099Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:43:07.811099Z digest=sha256:6cd60e234971ac96cf10e169de99212b30b95d23a33a500ce86a53a93a7a135e

Observation 1d8a31b4-d56b-4e9e-9abc-43af9b76335d · inbound

Lost in the Mix: Evaluating LLM Understanding of Code-Switched Text cites this paper.

Lost in the Mix: Evaluating LLM Understanding of Code-Switched Text The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T00:28:09.509245Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T00:28:09.509245Z digest=sha256:e874bcc5e8b6fecf70aa530b6e27d75d49e473c33b6409ce95fe340395143e70

Observation 3d170110-4d0f-4283-a254-f16331871022 · inbound

A Vietnamese Dataset for Text Segmentation and Multiple Choices Reading Comprehension cites this paper.

A Vietnamese Dataset for Text Segmentation and Multiple Choices Reading Comprehension The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-06T23:49:24.093318Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:49:24.093318Z digest=sha256:1c2d9d5fd3c9f7b17c5644dcf75a4393610a100718463597f13dd442b3ca1d4b

Observation 6cdb0b51-9bfc-47a8-8ffb-fd49eeacacdd · inbound

From Ambiguity to Accuracy: The Transformative Effect of Coreference Resolution on Retrieval-Augmented Generation systems cites this paper.

From Ambiguity to Accuracy: The Transformative Effect of Coreference Resolution on Retrieval-Augmented Generation systems The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

Reference 1

Resolution
metadata mismatch
arxiv_id, observed 2026-05-19T05:32:05.794157Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=pdf_text observed=2026-05-19T05:30:33.121799Z digest=sha256:04429a2531ffe6995a284baa8246cbecb395e67511dc08219b6ad11bbee748bb

Observation e2c362b1-a10c-423e-82e7-6427b600c90d · inbound

Improving Korean-English Cross-Lingual Retrieval: A Data-Centric Study of Language Composition and Model Merging cites this paper.

Improving Korean-English Cross-Lingual Retrieval: A Data-Centric Study of Language Composition and Model Merging The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

Reference 1

Resolution
verified exact
arxiv_id, observed 2026-05-22T00:40:51.024145Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=arxiv_source observed=2026-05-22T00:39:24.748381Z digest=sha256:3f047d56dcd7517312797e993fca02c5dbfe3f6719de77385239261f1eaf72b2

Observation 1b0a24ad-03f2-4b3a-995b-dd68e180a1cd · inbound

AgentScope 1.0: A Developer-Centric Framework for Building Agentic Applications cites this paper.

AgentScope 1.0: A Developer-Centric Framework for Building Agentic Applications The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-05T17:26:28.791709Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T17:26:28.791709Z digest=sha256:4f090c8ab4bf4017bef81ec2cab6ef9216be50997f4b3ecea98a3e7b88408cc7

Observation 2db290fc-bd00-4632-983f-50814d13c33d · inbound

A Data-Efficient Path to Multilingual LLMs: Language Expansion via Post-training PARAM$\Delta$ Integration into Upcycled MoE cites this paper.

A Data-Efficient Path to Multilingual LLMs: Language Expansion via Post-training PARAM$\Delta$ Integration into Upcycled MoE The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

Reference 27

Resolution
metadata mismatch
arxiv_id, observed 2026-05-20T11:13:13.604415Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.

source=arxiv_source observed=2026-05-20T11:09:22.027588Z digest=sha256:5bea109f1ad612e24cb65d3f39a4c52caba1a95965cad5c90960c9c872a8bd7b

Observation f372923f-1309-4463-829a-c640d0853e9f · inbound

Fairness Pruning: Locating Demographic Bias in GLU-MLP Layers via Differential Activations cites this paper.

Fairness Pruning: Locating Demographic Bias in GLU-MLP Layers via Differential Activations The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants

Reference 36

Resolution
unresolved
no resolver link, observed 2026-07-31T11:25:39.532395Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-31T11:25:39.532395Z digest=sha256:57ee9a610b7978b49969ec1d14fc3bee6ec82e140d4ec7c1fc750039fb563c80