Pith. sign in

Paper Citation Record · LEDGER

Pre-Training Curriculum for Multi-Token Prediction in Language Models

As of 8 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2505.22757.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.22757 v1

Coverage vector

measured 13 of 13 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:06:35.248084Z

measured 13 of 13 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

13 of 13 outbound references displayed

  • verified exact0
  • verified fuzzy2
  • unresolved11
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation e1de7c31-31c0-41cb-a6c9-fede6db9a382 · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 1

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:36.553245Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:06:34.707844Z digest=sha256:d48d31c78111947cc805eebe2512536235645c925ff9bf97fd01e166dfbfcbd5

Observation ce2a8469-eb02-4eec-bf18-c02e2bfa4338 · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:36.346913Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:06:34.802623Z digest=sha256:0c223ec9a355c2077b56250d0f78416f88a2b567fbd5927dd03cd780d3cd1bd4

Observation 1e41aa12-338e-4ee3-9a78-a50b1f06d5cc · outbound

This paper cites Better & Faster Large Language Models via Multi-token Prediction.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Better & Faster Large Language Models via Multi-token Prediction

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.362380Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.362380Z digest=sha256:02a9509c1c04a43b25c78117375ff07c7d0d1ceafab6d8ede7a0d9d1eb8ba1c4

Observation de485d5f-83eb-45d1-80a1-984e362c6066 · outbound

This paper cites Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.434972Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.434972Z digest=sha256:cbf04753eeaa667d03f4ab199699f26f3a8b762365ad8f41401966f8c939a1c7

Observation 73ee8a06-bd2e-4922-9c16-f57bea0744f2 · outbound

This paper cites Your task is to rate the written output sequence on one metric.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Your task is to rate the written output sequence on one metric

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:06:36.168632Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:06:34.896235Z digest=sha256:54008e87f12e9a0a49ef6b2b3f95ddcd844709dc7a2798f6c880f4f861b9665f

Observation b4da940d-4135-4371-b73f-2c79e3b66196 · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:36.025653Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:06:34.953689Z digest=sha256:e49907147fc3f2c6165adcbfd3ead9609008f5ea60c804a3231133661f55b02c

Observation b73d85a4-63bc-409b-92e9-ef29185f669c · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:35.842497Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:06:35.036520Z digest=sha256:d35d39ec59ff63b03c6412fc677c6f2599506119fc98eb9bf0cc87a962282b03

Observation 639ff016-e683-4963-8f32-361330087be6 · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:35.694279Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:06:35.139500Z digest=sha256:27912e42cea6f05cf3d01fd46595ce80a0350c113f5bdb775a3ac108257c0594

Observation 85d0af89-6751-4ab6-986c-ad3b0dcdd654 · outbound

This paper cites Please refer to Warstadt et al.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Please refer to Warstadt et al

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:06:35.514559Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-08-07T13:06:35.248084Z digest=sha256:33c7fd17c8f836c620d6c0db6070d7fe117d27024da690c360fd2e2223d6aa12

Observation 398202df-698a-490c-9b32-685e78db22a5 · outbound

This paper cites Curriculum Learning: A Survey.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Curriculum Learning: A Survey

Reference 2016

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.541220Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.541220Z digest=sha256:270df00b0209fc92e2cb782115d6d49fe8adbc5f25c2d133179d71ecd999a09b

Observation 04d52ef0-f572-478f-9799-441abc2aa559 · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

Pre-Training Curriculum for Multi-Token Prediction in Language Models LLaMA: Open and Efficient Foundation Language Models

Reference 2018

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.640070Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.640070Z digest=sha256:1d92a8863dbfef4082af053b03b62e966aadf8df1ae84ee780d3fbf5cf9bb1b5

Observation c21b578c-2f79-49e0-bf3c-739d9762956a · outbound

This paper cites SemScore: Automated Evaluation of Instruction-Tuned LLMs based on Semantic Textual Similarity.

Pre-Training Curriculum for Multi-Token Prediction in Language Models SemScore: Automated Evaluation of Instruction-Tuned LLMs based on Semantic Textual Similarity

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.204491Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.204491Z digest=sha256:fef0389ed77b8ed05bb1b15996fc1fee8a10d4e5fe3bfcb8732530ed28519b40

Observation b3a39a96-a593-49f8-8f24-eb5a4933cb99 · outbound

This paper cites Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.266008Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.266008Z digest=sha256:2e64b2e03ea886460063573b156cc6690462535e1da479281823737496636656

Pith citing papers

No inbound Pith citation observations are available.