Pith. sign in

Paper Citation Record · LEDGER

Pre-Training Curriculum for Multi-Token Prediction in Language Models

As of 13 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2505.22757.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.22757 v1

Coverage vector

measured 13 of 13 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:06:35.248084Z

measured 13 of 13 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-12T06:34:41.77262+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

13 of 13 outbound references displayed

  • verified exact0
  • verified fuzzy2
  • unresolved11
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation e1de7c31-31c0-41cb-a6c9-fede6db9a382 · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 1

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:36.553245Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-07T13:06:34.707844Z digest=sha256:09e4f0a8cc286d415197076e678973aea5bf35fa43b17152b67acd9ef1c97f40

Observation ce2a8469-eb02-4eec-bf18-c02e2bfa4338 · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:36.346913Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-07T13:06:34.802623Z digest=sha256:b5457785ed4de579adfa0942933f0b36814877d813c1f08e16ee63dfb3447e88

Observation 1e41aa12-338e-4ee3-9a78-a50b1f06d5cc · outbound

This paper cites Better & Faster Large Language Models via Multi-token Prediction.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Better & Faster Large Language Models via Multi-token Prediction

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.362380Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.362380Z digest=sha256:4ac96162f1331e06c2709f9cc1a50c9b3807bf622cf6f3f8d2d82091ed44f6aa

Observation de485d5f-83eb-45d1-80a1-984e362c6066 · outbound

This paper cites Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Findings of the Second BabyLM Challenge: Sample-Efficient Pretraining on Developmentally Plausible Corpora

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.434972Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.434972Z digest=sha256:88f686196acefc479c2024865b531f871a31bd9ed09f591c6e3498882ca0b254

Observation 73ee8a06-bd2e-4922-9c16-f57bea0744f2 · outbound

This paper cites Your task is to rate the written output sequence on one metric.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Your task is to rate the written output sequence on one metric

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:06:36.168632Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-07T13:06:34.896235Z digest=sha256:48f68fa44b20f79522550497fd4eb44d9a0d3d02e8f4a7962fa3257d6916938c

Observation b4da940d-4135-4371-b73f-2c79e3b66196 · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:36.025653Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-07T13:06:34.953689Z digest=sha256:69d32a25826ba70832d11cb500854b5431a1b3cc62e74988ed632770ea38341f

Observation b73d85a4-63bc-409b-92e9-ef29185f669c · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:35.842497Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-07T13:06:35.036520Z digest=sha256:e0f899588d277bfb84a7eb368903ebb2c1e4ee1ad36ac4c2bfffdb739cea771a

Observation 639ff016-e683-4963-8f32-361330087be6 · outbound

This paper cites an unresolved cited work.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-07T13:06:35.694279Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-07T13:06:35.139500Z digest=sha256:e0a271975694361aeaeb7668c5275c76f199b2f798dbb0d8f6fc716cf1ba89f9

Observation 85d0af89-6751-4ab6-986c-ad3b0dcdd654 · outbound

This paper cites Please refer to Warstadt et al.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Please refer to Warstadt et al

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T13:06:35.514559Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-08-07T13:06:35.248084Z digest=sha256:7850fa9c8fe4e5746ddd3e9867d9078cb339c94de71cbf395fc92f43e1f04935

Observation 398202df-698a-490c-9b32-685e78db22a5 · outbound

This paper cites Curriculum Learning: A Survey.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Curriculum Learning: A Survey

Reference 2016

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.541220Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.541220Z digest=sha256:39614f08605615bd32ef97ac6f85aff48a834bf16c5229e723d0283492d0d162

Observation 04d52ef0-f572-478f-9799-441abc2aa559 · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

Pre-Training Curriculum for Multi-Token Prediction in Language Models LLaMA: Open and Efficient Foundation Language Models

Reference 2018

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.640070Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.640070Z digest=sha256:062eb7428e71c38ce4b0e36161e2781a5ca8c291fbdf4c4daccc2b1a53c971d4

Observation c21b578c-2f79-49e0-bf3c-739d9762956a · outbound

This paper cites SemScore: Automated Evaluation of Instruction-Tuned LLMs based on Semantic Textual Similarity.

Pre-Training Curriculum for Multi-Token Prediction in Language Models SemScore: Automated Evaluation of Instruction-Tuned LLMs based on Semantic Textual Similarity

Reference 2021

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.204491Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.204491Z digest=sha256:8a6290e98445f6f1c330f9637584ebacbc5d6f6b6eb41e4e4034bb1cf3bc7c70

Observation b3a39a96-a593-49f8-8f24-eb5a4933cb99 · outbound

This paper cites Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads.

Pre-Training Curriculum for Multi-Token Prediction in Language Models Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-07T13:06:34.266008Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:06:34.266008Z digest=sha256:7ad0abe277d19345d790a24ad99b0e0282348a6b44deb16b923b6bfc8046eaae

Pith citing papers

No inbound Pith citation observations are available.