Pith. sign in

Paper Citation Record · LEDGER

XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2003.11080.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2003.11080 v5

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 14 of 14 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 14 of 14 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-08T16:17:55.208166Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-04T06:39:37.931716Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 18907a1a-90fe-4bcd-8478-ade113585b75 · inbound

CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation cites this paper.

CodeXGLUE: A Machine Learning Benchmark Dataset for Code Understanding and Generation XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Reference 34

Resolution
verified exact
arxiv_id, observed 2026-05-15T11:40:02.705943Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-15T11:40:02.535705Z digest=sha256:dc7b44b03f282b1a8cdd3ddc01ed1adf583a2cab8212fcdcdc938e5cf2f9f7e0

Observation de72cbe9-207d-428d-9064-f69c861f5252 · inbound

Find Central Dogma Again: Leveraging Multilingual Transfer in Large Language Models cites this paper.

Find Central Dogma Again: Leveraging Multilingual Transfer in Large Language Models XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-08T16:17:55.208166Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T16:17:55.208166Z digest=sha256:25dd63420d369a18cff87e028c0d0a996f9ac02aaed7569fabc09476047e9b96

Observation 30ce7d7c-e140-433a-aa74-68bf6a46cf12 · inbound

Beyond Literal Token Overlap: Token Alignability for Multilinguality cites this paper.

Beyond Literal Token Overlap: Token Alignability for Multilinguality XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-08T15:23:18.545765Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-08T15:23:18.545765Z digest=sha256:822465e01d4496001d6da133593abf6877a2caf584f221a267e53301e3ab2039

Observation d9210a17-1ff2-46c4-8e4e-19ad100dc4ea · inbound

Prompt, Translate, Fine-Tune, Re-Initialize, or Instruction-Tune? Adapting LLMs for In-Context Learning in Low-Resource Languages cites this paper.

Prompt, Translate, Fine-Tune, Re-Initialize, or Instruction-Tune? Adapting LLMs for In-Context Learning in Low-Resource Languages XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T23:14:41.164749Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:14:41.164749Z digest=sha256:6bb0f0b87e270517661d51c6e1b650bf84e1544ae547c4b58071ed8c8edc23d8

Observation 9f774038-6df0-4bf6-9146-42aaeb8ca83c · inbound

Breaking Physical and Linguistic Borders: Multilingual Federated Prompt Tuning for Low-Resource Languages cites this paper.

Breaking Physical and Linguistic Borders: Multilingual Federated Prompt Tuning for Low-Resource Languages XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-06T20:57:39.815950Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:57:39.815950Z digest=sha256:2b7593c1d6af708c21d9b4601082e120b32efd48a4317624a67ccd52c2324d39

Observation d65328bd-02aa-4b54-a32c-7e969f9a890a · inbound

When Alignment Hurts: Decoupling Representational Spaces in Multilingual Models cites this paper.

When Alignment Hurts: Decoupling Representational Spaces in Multilingual Models XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-05T19:23:50.740968Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T19:23:50.740968Z digest=sha256:deeac35f3cc0e59a5ad739c5148191a75e3eeee6d15505788311775cdb8ddd82

Observation 3536f4d6-026f-4973-843e-3bcd961e2bf7 · inbound

KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino cites this paper.

KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-05T04:34:14.946810Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T04:34:14.946810Z digest=sha256:863340a7d904a4aeb2183ec60d36092e3c456e6c85cf6458ada06c4440819eb7

Observation 41e97dda-1a9a-48b2-a6eb-5aabc21cfc25 · inbound

Learning from AVA: Early Lessons from a Curated and Trustworthy Generative AI for Policy and Development Research cites this paper.

Learning from AVA: Early Lessons from a Curated and Trustworthy Generative AI for Policy and Development Research XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-05-10T12:10:22.873986Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-10T04:38:00.482850Z digest=sha256:a044c9c98d4e86f9992b8aa900aed6ff8aa05b12e7e23bb24c83bbb28e06e694

Observation 08150bc2-cea2-4210-9d59-db59e5aa671f · inbound

Nsanku: Evaluating Zero-Shot Translation Performance of LLMs for Ghanaian Languages cites this paper.

Nsanku: Evaluating Zero-Shot Translation Performance of LLMs for Ghanaian Languages XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Reference 17

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T17:36:04.703734Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-08T17:26:34.712711Z digest=sha256:7c8d7fb56c4700181e59a527b89eb30827e85a62e2ef4eb993bbbf71addaffd1

Observation a842e28e-9ede-4402-8ab0-5edfbf65fc86 · inbound

YEZE at SemEval-2026 Task 9: Detecting Multilingual, Multicultural and Multievent Online Polarization via Heterogeneous Ensembling cites this paper.

YEZE at SemEval-2026 Task 9: Detecting Multilingual, Multicultural and Multievent Online Polarization via Heterogeneous Ensembling XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Reference 42

Resolution
verified exact
arxiv_id, observed 2026-05-11T19:56:09.811493Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-05-08T10:36:49.007747Z digest=sha256:92a048efda1eb8a18fea4f8702b258e2242bd69c1949926f98f1238ad4e3865e

Observation 841dd11a-9d47-4b83-8f91-f2dc75dd9eea · inbound

YEZE at SemEval-2026 Task 9: Detecting Multilingual, Multicultural and Multievent Online Polarization via Heterogeneous Ensembling cites this paper.

YEZE at SemEval-2026 Task 9: Detecting Multilingual, Multicultural and Multievent Online Polarization via Heterogeneous Ensembling XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Reference 42

Resolution
verified exact
arxiv_id, observed 2026-05-12T08:06:29.634880Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-05-12T01:17:56.012044Z digest=sha256:2573af1703c04842e85685c88f975117ad19811653f8b951b1b690deef829eb6

Observation 90edcdfb-3009-4f69-9611-1d20cff424d6 · inbound

Pretraining Language Models with Subword Regularization: An Empirical Study of BPE Dropout in Low-Resource NLP cites this paper.

Pretraining Language Models with Subword Regularization: An Empirical Study of BPE Dropout in Low-Resource NLP XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Reference 11

Resolution
verified exact
arxiv_id, observed 2026-05-14T19:32:52.685449Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-14T19:29:22.229589Z digest=sha256:ffc444d71f43c8eacba3c7ac81c06b2474a8e9e26de4536b1bdb4d6a21cbd8a8

Observation 21c6a5dd-3c1f-4852-9706-61dd87330d6e · inbound

Code-Switching Reveals Language Anchoring in Multilingual LLMs cites this paper.

Code-Switching Reveals Language Anchoring in Multilingual LLMs XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Reference 3

Resolution
metadata mismatch
arxiv_id, observed 2026-07-04T03:19:30.804077Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-26T18:13:50.141189Z digest=sha256:74f06fdbcbf8d407d58e554cbdd970be1ba3be939490551f50e993244f9a5529

Observation f23461e6-226a-434e-a77f-0d7b965d4e54 · inbound

Behavioral and Representational Evidence of Binomial Ordering Preferences in Large Language Models cites this paper.

Behavioral and Representational Evidence of Binomial Ordering Preferences in Large Language Models XTREME: A Massively Multilingual Multi-task Benchmark for Evaluating Cross-lingual Generalization

Reference 260

Resolution
verified exact
arxiv_id, observed 2026-07-04T06:39:37.933196Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-06-26T14:18:11.215278Z digest=sha256:62d1e149eb8fafc50b8aeaf1e0e05a77461e3e0e52e1cac21292db374e1d9276