Pith. sign in

Paper Citation Record · LEDGER

YuLan-Mini: An Open Data-efficient Language Model

As of 17 August 2026, this Paper Citation Record lists 100 of 135 outbound references and 2 inbound Pith citation observations for arXiv:2412.17743.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2412.17743 v2

Coverage vector

measured 100 of 135 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-11T05:17:55.889322Z

measured 102 of 102 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-17T06:30:58.91139+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-06T11:44:04.984553Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-06-28T22:42:47.026295Z

Reference resolution

100 of 135 outbound references displayed

  • verified exact1
  • verified fuzzy0
  • unresolved99
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation df77c6d9-4f40-4203-bedf-43a1607a9ad6 · outbound

This paper cites Synthetically generated reasoning dataset (gsm8k-inspired) with enhanced diversity using gretel navigator and meta-llama/meta-llama-3.1-405b.

YuLan-Mini: An Open Data-efficient Language Model Synthetically generated reasoning dataset (gsm8k-inspired) with enhanced diversity using gretel navigator and meta-llama/meta-llama-3.1-405b

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.471132Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.471132Z digest=sha256:a3bea8bcb98737e268940659485c845dbd5c7a3394d620756bb89a012625ba89

Observation f4218e80-733e-4b6f-b694-44c605f6f83e · outbound

This paper cites GQA: training generalized multi-query transformer models from multi-head checkpoints.

YuLan-Mini: An Open Data-efficient Language Model GQA: training generalized multi-query transformer models from multi-head checkpoints

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.476338Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.476338Z digest=sha256:196fc09039bef8796abbd6c9a8e30602cf0c11fedaf1ee5e72374f81fbc7ccdd

Observation 47c0352e-4240-465a-ad63-c8eb4b1d05d6 · outbound

This paper cites Smollm2 - with great data, comes great performance, 2024.

YuLan-Mini: An Open Data-efficient Language Model Smollm2 - with great data, comes great performance, 2024

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.481319Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.481319Z digest=sha256:6df6e402a0f0dc71a73bc056f3c13e3cfd0ccaccef8d273ec9addad4634d6e82

Observation e37bebbe-739c-44fd-9835-bf0361a23c9a · outbound

This paper cites Program Synthesis with Large Language Models.

YuLan-Mini: An Open Data-efficient Language Model Program Synthesis with Large Language Models

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.485739Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.485739Z digest=sha256:52e7709723c13260f07a33c150a70f622b16b4191eb96088df4768d715908ce8

Observation 3c185ad2-d8ba-4e5a-8194-27ed0d1b079e · outbound

This paper cites Jiang, Jia Deng, Stella Biderman, and Sean Welleck.

YuLan-Mini: An Open Data-efficient Language Model Jiang, Jia Deng, Stella Biderman, and Sean Welleck

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.489943Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.489943Z digest=sha256:6c520ba2008b0ba516aade703f0c3da10ca0d76c7cd982e7c68b7f151579a2eb

Observation e94615bc-fb03-40db-b562-11ac0fae0d5d · outbound

This paper cites Layer Normalization.

YuLan-Mini: An Open Data-efficient Language Model Layer Normalization

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.493672Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.493672Z digest=sha256:663e6815d3660513a85767d69b59145078bf6d0260d302f4c52d53ecd5cd4c04

Observation 0e699dc9-a885-4867-ac49-624da63de074 · outbound

This paper cites Numinamath 7b cot, 2024.

YuLan-Mini: An Open Data-efficient Language Model Numinamath 7b cot, 2024

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.498666Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.498666Z digest=sha256:f34f9197d6113c442cd70a437f1450885e1aa5d52767b2fcba46adcd123b1af3

Observation 272b80f4-77c6-4adf-a15c-c943b17e1b84 · outbound

This paper cites Stable LM 2 1.6B Technical Report.

YuLan-Mini: An Open Data-efficient Language Model Stable LM 2 1.6B Technical Report

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.502568Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.502568Z digest=sha256:46f5f9836159189e911f75e2febe990f47b9b31b6e21ee8df4c440fa90c42fae

Observation fbf056b8-538a-4826-b382-f64b47e8f88c · outbound

This paper cites DeepSeek LLM: Scaling Open-Source Language Models with Longtermism.

YuLan-Mini: An Open Data-efficient Language Model DeepSeek LLM: Scaling Open-Source Language Models with Longtermism

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.507213Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.507213Z digest=sha256:9302d0cc68bd78b81359c5584d3da7a78868e13b8abcbdf1c5bf17b388ca6b59

Observation 95f3bacb-3738-4743-8d1c-e8fc6ca2ccde · outbound

This paper cites Enriching word vectors with subword information.

YuLan-Mini: An Open Data-efficient Language Model Enriching word vectors with subword information

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.511890Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.511890Z digest=sha256:2fed312afbc61b7ed02ba86a255bbe15a4d6ff0817c94be69c22075a478569fa

Observation 02e4b734-3974-4cec-a258-a447529ed422 · outbound

This paper cites Language Models are Few-Shot Learners.

YuLan-Mini: An Open Data-efficient Language Model Language Models are Few-Shot Learners

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.515998Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.515998Z digest=sha256:083f26408bc5abe7320a998097796b3a7fe5e8a9c7c13ccefed7b1e6ee439a70

Observation 9872fc41-c8f6-4414-b6d4-029bdfe30fa2 · outbound

This paper cites Towards Effective and Efficient Continual Pre-training of Large Language Models.

YuLan-Mini: An Open Data-efficient Language Model Towards Effective and Efficient Continual Pre-training of Large Language Models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.520414Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.520414Z digest=sha256:d1b6a6ce55fe500341f650c75b32c4594dc89cfb09cd9c71b5c359390884cf89

Observation b69e5e27-df9c-4063-ac7d-257c56c29113 · outbound

This paper cites Evaluating Large Language Models Trained on Code.

YuLan-Mini: An Open Data-efficient Language Model Evaluating Large Language Models Trained on Code

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.524982Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.524982Z digest=sha256:a9927550ad04cd56e5597b941046c7860ce5a43014c1750fdd4b8cdcdac0ca28

Observation e5f94ab0-63e4-4d26-aeb0-e904cbdb294f · outbound

This paper cites Extending Context Window of Large Language Models via Positional Interpolation.

YuLan-Mini: An Open Data-efficient Language Model Extending Context Window of Large Language Models via Positional Interpolation

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.529338Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.529338Z digest=sha256:60fbfc8c07bd8c4dea934edee1bf37c1b0a0731689a51e8f62d42fd5a97392ad

Observation ed4ff887-4d77-4b69-b3f9-260798e02840 · outbound

This paper cites an unresolved cited work.

YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.533625Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.533625Z digest=sha256:2fc6467b57a7268790d0829fa2b523c5c8c045445015adb93ae7c4ea39272462

Observation cb83bf82-f089-408a-ae44-9bd1c40c0646 · outbound

This paper cites Stable language model pre-training by reducing embedding variability.

YuLan-Mini: An Open Data-efficient Language Model Stable language model pre-training by reducing embedding variability

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.537912Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.537912Z digest=sha256:d1a62feff31e35c24559b792066e50c340a121ae8983f104ed9e62d8c22d643a

Observation da012ea5-0bc2-42ae-97f6-7f9ba1d720ed · outbound

This paper cites Training Verifiers to Solve Math Word Problems.

YuLan-Mini: An Open Data-efficient Language Model Training Verifiers to Solve Math Word Problems

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.542009Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.542009Z digest=sha256:17e8fd4021770bc7494c30a1350697851a534add8aa9bff55018f093d9a47c35

Observation 22b90065-8b4c-4236-b9db-83e8981b7c1d · outbound

This paper cites Getting the most out of your tokenizer for pre-training and domain adaptation.

YuLan-Mini: An Open Data-efficient Language Model Getting the most out of your tokenizer for pre-training and domain adaptation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.546543Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.546543Z digest=sha256:6a2207417e01c3a0daaaa0b889066bea1aaa3643205d589ac43550b13cc5cb1d

Observation fba000f4-a138-4d21-aa15-c521de1ca8e9 · outbound

This paper cites Flashattention-2: Faster attention with better parallelism and work partitioning.

YuLan-Mini: An Open Data-efficient Language Model Flashattention-2: Faster attention with better parallelism and work partitioning

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.550757Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.550757Z digest=sha256:0deac881101a59b952e6e6c3ffd7bcfbec1a97c34b21bba986a23a5dec533769

Observation bbf71baf-c53e-483b-8904-4493fbe45e2e · outbound

This paper cites Fu, Stefano Ermon, Atri Rudra, and Christopher R \' e.

YuLan-Mini: An Open Data-efficient Language Model Fu, Stefano Ermon, Atri Rudra, and Christopher R \' e

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.554907Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.554907Z digest=sha256:69c9c5fe5880717b17ba2968743c4d8cf52335c9b498a4d997a226f6933a583b

Observation 30bc93ab-dd92-45a3-970a-41c9f2d2daae · outbound

This paper cites The Z-loss: a shift and scale invariant classification loss belonging to the Spherical Family.

YuLan-Mini: An Open Data-efficient Language Model The Z-loss: a shift and scale invariant classification loss belonging to the Spherical Family

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.558844Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.558844Z digest=sha256:98acecbb7aee7afafade48facb26966a68ada99c6091dce455adee4732cdff2b

Observation bc5c1223-b083-41f4-94d7-3c48f1089703 · outbound

This paper cites DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model.

YuLan-Mini: An Open Data-efficient Language Model DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.563036Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.563036Z digest=sha256:1300ad0a47eade3c6f5c5059a75760be6f86ef1f5054c4e545053a1a59d1a020

Observation af3b0201-dff7-427d-b99f-80d6287253a9 · outbound

This paper cites Cerebras-GPT: Open Compute-Optimal Language Models Trained on the Cerebras Wafer-Scale Cluster.

YuLan-Mini: An Open Data-efficient Language Model Cerebras-GPT: Open Compute-Optimal Language Models Trained on the Cerebras Wafer-Scale Cluster

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.567673Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.567673Z digest=sha256:b489e7f6da02174972c4333a234bfcce90e295d51b60f10ddc306139e8032810

Observation ccd84ed2-68ac-41d0-8c31-aacf436a642b · outbound

This paper cites Cerebras-GPT: Open Compute-Optimal Language Models Trained on the Cerebras Wafer-Scale Cluster.

YuLan-Mini: An Open Data-efficient Language Model Cerebras-GPT: Open Compute-Optimal Language Models Trained on the Cerebras Wafer-Scale Cluster

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.572114Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.572114Z digest=sha256:d129c4ed82f801da3f55866f628bb1a0de51f8803ee4145d0a5a56e984d3f4e4

Observation 36df1169-9b02-4f39-bcb4-79dc5fccd27e · outbound

This paper cites Fewer truncations improve language modeling.

YuLan-Mini: An Open Data-efficient Language Model Fewer truncations improve language modeling

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.576433Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.576433Z digest=sha256:bb93ed9ca85e4fd0a2a5fd377fc14effec4fdce116263e78e7f9cbdefbaa5dc5

Observation 22e330f8-59c7-45d4-86a3-afa5ed5e212f · outbound

This paper cites Unleashing LLM Reasoning Capability via Scalable Question Synthesis from Scratch.

YuLan-Mini: An Open Data-efficient Language Model Unleashing LLM Reasoning Capability via Scalable Question Synthesis from Scratch

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.581180Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.581180Z digest=sha256:e5511aa99385d088323e906aa75ed802e4d468cde4fedea8495c4db741e43ed2

Observation 03f5878e-5136-4877-9845-24c75587f9f5 · outbound

This paper cites The Llama 3 Herd of Models.

YuLan-Mini: An Open Data-efficient Language Model The Llama 3 Herd of Models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.585075Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.585075Z digest=sha256:9f816b41dd9200f488858e0d4aa2b0f81317e417622afec7b1e9790c2eff0c65

Observation b9452567-fcfc-43d5-b05b-1ed6feac7507 · outbound

This paper cites How to train long-context language models (effectively).

YuLan-Mini: An Open Data-efficient Language Model How to train long-context language models (effectively)

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.589435Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.589435Z digest=sha256:b45db1b8f941bce6b8f66a460010f19dbe2af4a5e85dc2ca243058b1e4f3e99d

Observation 9a6e0d48-8c4e-4080-af5c-01b40a15c30b · outbound

This paper cites an unresolved cited work.

YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.593442Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.593442Z digest=sha256:1e01453a6b8ca1cd9a39bd2f9bd0bdfafd5fe25361fda08a3f3142f8e793e61c

Observation f1605bc3-5fd9-4b9b-b773-7caf82493577 · outbound

This paper cites DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence.

YuLan-Mini: An Open Data-efficient Language Model DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.597466Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.597466Z digest=sha256:d28d5bcd72bc659f81d2fd5a83bd38f984ed6a282eb6e51718989b59203db160

Observation 6a403ff7-89b4-4607-92e6-f7666643267d · outbound

This paper cites Scaling Laws and Compute-Optimal Training Beyond Fixed Training Durations.

YuLan-Mini: An Open Data-efficient Language Model Scaling Laws and Compute-Optimal Training Beyond Fixed Training Durations

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.601448Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.601448Z digest=sha256:47bf40ef1ebf7f82c8a3811d45b9ac94991f993e984bb6d71a261a55b0d63b09

Observation 2ddbd7f9-26bc-4f36-ac4f-33c67402dd97 · outbound

This paper cites InfiMM-WebMath-40B: Advancing Multimodal Pre-Training for Enhanced Mathematical Reasoning.

YuLan-Mini: An Open Data-efficient Language Model InfiMM-WebMath-40B: Advancing Multimodal Pre-Training for Enhanced Mathematical Reasoning

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.605726Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.605726Z digest=sha256:aae53fec6b1d85a955be0b1ab233192861b33adc4443867d17a46709c16c3ecf

Observation 63e25bf4-9410-445f-8098-cb5f101cb6e8 · outbound

This paper cites WanJuan: A Comprehensive Multimodal Dataset for Advancing English and Chinese Large Models.

YuLan-Mini: An Open Data-efficient Language Model WanJuan: A Comprehensive Multimodal Dataset for Advancing English and Chinese Large Models

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.610187Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.610187Z digest=sha256:40074c81d2690304e3ceee994c980c6e31e89f187942cc0ee8bd75917fb4c998

Observation f3b6e776-e0ee-41e8-bbe1-24af0c471084 · outbound

This paper cites Measuring massive multitask language understanding.

YuLan-Mini: An Open Data-efficient Language Model Measuring massive multitask language understanding

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.615373Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.615373Z digest=sha256:831e42cc31774e3a499f6c028b6b76dee325efb4dadb2a77eea28a4d40542c7b

Observation 0f9d24a7-59ad-4173-a868-dccd6a75ca9a · outbound

This paper cites Measuring mathematical problem solving with the MATH dataset.

YuLan-Mini: An Open Data-efficient Language Model Measuring mathematical problem solving with the MATH dataset

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.619133Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.619133Z digest=sha256:e7173f4cd850d0df34a7277faa6706e912ed3afb2ac45f8b020b623772f924f9

Observation 3c4af250-12f0-4265-a334-039538d6197e · outbound

This paper cites RULER: What's the Real Context Size of Your Long-Context Language Models?.

YuLan-Mini: An Open Data-efficient Language Model RULER: What's the Real Context Size of Your Long-Context Language Models?

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.622904Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.622904Z digest=sha256:0ab6b227c0d5b50784bd013fd5c8a1fc7e67dec6b3506df31023f75ffbac9ce2

Observation 4e44f159-f1be-4f96-95af-8b6c3daa637e · outbound

This paper cites Liger Kernel: Efficient Triton Kernels for LLM Training.

YuLan-Mini: An Open Data-efficient Language Model Liger Kernel: Efficient Triton Kernels for LLM Training

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.627059Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.627059Z digest=sha256:05d2b6cc2161478400cdfd95588ef8ede8d95d8ff492796e806b6fffbbce3b7c

Observation 543551f6-61da-48a3-9c78-d6bea96bef33 · outbound

This paper cites MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies.

YuLan-Mini: An Open Data-efficient Language Model MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.631254Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.631254Z digest=sha256:3f07e951b22862d0bb79a0bc098fe74d23d767bb4e6c3dba0639e90f440d5563

Observation af6f29f5-c0f0-4490-bdc5-37df4a1b3eae · outbound

This paper cites Towards reasoning in large language models: A survey.

YuLan-Mini: An Open Data-efficient Language Model Towards reasoning in large language models: A survey

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.635377Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.635377Z digest=sha256:411502a13081f6c901d5b3f2448962ab8a50fd0aaa444414b108de75dbcae6ab

Observation fd4a7a7c-209e-4ac8-8610-9380619344df · outbound

This paper cites OpenCoder: The Open Cookbook for Top-Tier Code Large Language Models.

YuLan-Mini: An Open Data-efficient Language Model OpenCoder: The Open Cookbook for Top-Tier Code Large Language Models

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.639091Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.639091Z digest=sha256:616ea61b31e8a9c1e368c5049d18460bc1a4fbdab7fdb57f91c1b3133c4cd948

Observation 7b105f39-5c3a-44cd-87fe-c318ad56a07d · outbound

This paper cites C-eval: A multi-level multi-discipline chinese evaluation suite for foundation models.

YuLan-Mini: An Open Data-efficient Language Model C-eval: A multi-level multi-discipline chinese evaluation suite for foundation models

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.643976Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.643976Z digest=sha256:57593827ea29b468b8e8d1886760f9ab0c6c606ffb16fd0f5e544f8d31b608f5

Observation 240854d5-6f3e-4d93-b7b2-5728c82054bd · outbound

This paper cites Enhancing LLM Reasoning with Reward-guided Tree Search.

YuLan-Mini: An Open Data-efficient Language Model Enhancing LLM Reasoning with Reward-guided Tree Search

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.648063Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.648063Z digest=sha256:968f63b95d95061405bec3afada1027257665ce953902ee837a242271fdc174b

Observation 7953ac66-43f5-4b25-a25c-99c2f4eace53 · outbound

This paper cites TinyBERT: Distilling BERT for Natural Language Understanding.

YuLan-Mini: An Open Data-efficient Language Model TinyBERT: Distilling BERT for Natural Language Understanding

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.652243Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.652243Z digest=sha256:b852bf4fae326c4ab7ce497bbb44e428bd7a64f97fbbdea1fc0bb43f7df26cba

Observation c751306f-b105-4e1b-a7a1-8fda87d4eb45 · outbound

This paper cites Calc-x and calcformers: Empowering arithmetical chain-of-thought through interaction with symbolic systems.

YuLan-Mini: An Open Data-efficient Language Model Calc-x and calcformers: Empowering arithmetical chain-of-thought through interaction with symbolic systems

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.656023Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.656023Z digest=sha256:81a78cf8464c2525740a77172c20eb200f5a27dd22c8241d66bf5c7486461907

Observation d7630e91-5b85-4337-a9ec-4517ff9cb306 · outbound

This paper cites Kaplan, Sam McCandlish, T.

YuLan-Mini: An Open Data-efficient Language Model Kaplan, Sam McCandlish, T

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.659548Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.659548Z digest=sha256:680eee57b0590432eefab83cbb0359277002833617d3a565643e7f46ce1e1ff7

Observation 792d3be0-7377-4567-be23-a8fbd389d9d1 · outbound

This paper cites LAMBADA: backward chaining for automated reasoning in natural language.

YuLan-Mini: An Open Data-efficient Language Model LAMBADA: backward chaining for automated reasoning in natural language

Reference 46

Resolution
verified exact
doi, observed 2026-08-11T05:17:56.539446Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=arxiv_source observed=2026-08-11T05:17:55.663382Z digest=sha256:76c5f49cddfbd43f16d19379f699897feccecd62203e92a959e6c25a0f84c036

Observation 60c94e68-27d2-4cfe-ae69-1de60d8ecccf · outbound

This paper cites Strategic Data Ordering: Enhancing Large Language Model Performance through Curriculum Learning.

YuLan-Mini: An Open Data-efficient Language Model Strategic Data Ordering: Enhancing Large Language Model Performance through Curriculum Learning

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.666929Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.666929Z digest=sha256:4d5d37f5145a2c1bbb7835dfd1f62b63a503243cdf47e4c5ce1e33926551cd3f

Observation 4057b232-8906-43bd-8b28-ad50ea8af76f · outbound

This paper cites Efficient memory management for large language model serving with pagedattention.

YuLan-Mini: An Open Data-efficient Language Model Efficient memory management for large language model serving with pagedattention

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.672190Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.672190Z digest=sha256:da02705aa44adabf4da4664896c303dbb5834d9abd4ed7d5cc2d6f6ffaa9659b

Observation 1698723c-f8f3-438e-a616-b412cc3819df · outbound

This paper cites RACE: Large-scale ReAding Comprehension Dataset From Examinations.

YuLan-Mini: An Open Data-efficient Language Model RACE: Large-scale ReAding Comprehension Dataset From Examinations

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.676267Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.676267Z digest=sha256:5bec8a0fc04c45cfcf68508e55aa40a055ea544e58737b708c2312d10304e67d

Observation 3d73b432-089c-424a-ad9f-463f6bf7e903 · outbound

This paper cites Tulu 3: Pushing Frontiers in Open Language Model Post-Training.

YuLan-Mini: An Open Data-efficient Language Model Tulu 3: Pushing Frontiers in Open Language Model Post-Training

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.680324Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.680324Z digest=sha256:a00df5974a9b793817a55b9cdd8bba97ee401b3e57901b348a8063e51b04f4b8

Observation e1f626a6-a936-45c9-830e-18f7d7523ff6 · outbound

This paper cites To FP8 and Back Again: Quantifying Reduced Precision Effects on LLM Training Stability.

YuLan-Mini: An Open Data-efficient Language Model To FP8 and Back Again: Quantifying Reduced Precision Effects on LLM Training Stability

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.684447Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.684447Z digest=sha256:9b95b6c966012003a32e4697d81526450677bd5267d2f3a032e65335bbde68a7

Observation e646169e-494e-4935-aa76-3bc0cb5be7e1 · outbound

This paper cites The stability-efficiency dilemma: Investigating sequence length warmup for training GPT models.

YuLan-Mini: An Open Data-efficient Language Model The stability-efficiency dilemma: Investigating sequence length warmup for training GPT models

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.688724Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.688724Z digest=sha256:87dba39eae84a0c0bfeb080c6a175f54b1c12bc5d137436270b22f15709e372e

Observation ef7c6435-63ab-4922-b7b1-43c270f1fd16 · outbound

This paper cites CMMLU: measuring massive multitask language understanding in chinese.

YuLan-Mini: An Open Data-efficient Language Model CMMLU: measuring massive multitask language understanding in chinese

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.692410Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.692410Z digest=sha256:2740a1f957f8149fdb17c8267beecbe9ee9430bc6d61e3685535a958d54117c4

Observation 0e8be959-aca8-4043-81cc-e0592cffea2d · outbound

This paper cites DataComp-LM: In search of the next generation of training sets for language models.

YuLan-Mini: An Open Data-efficient Language Model DataComp-LM: In search of the next generation of training sets for language models

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.696737Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.696737Z digest=sha256:953c0d052877d1979e70119cd511056865c28c245a71d315fa3b06a8ca059bf7

Observation 200054d4-573d-4a44-9017-415b27af45b3 · outbound

This paper cites Numinamath.

YuLan-Mini: An Open Data-efficient Language Model Numinamath

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.701333Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.701333Z digest=sha256:a98af2320f58cd342f9aae5d287e3b7f84d5655ff74ddc47ba2a74d31cb9d5af

Observation a1ecbb9f-8465-4419-9f0f-fc3cf894a521 · outbound

This paper cites an unresolved cited work.

YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.704949Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.704949Z digest=sha256:064cf029776d6756449a7e06abc558ee82763d1ce717b5d0addba90ee369308b

Observation ab00372e-7f4b-4e68-9899-323b816fbd19 · outbound

This paper cites Slimorca: An open dataset of gpt-4 augmented flan reasoning traces, with verification, 2023.

YuLan-Mini: An Open Data-efficient Language Model Slimorca: An open dataset of gpt-4 augmented flan reasoning traces, with verification, 2023

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.709214Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.709214Z digest=sha256:64da7d715e1941b70c7b6392b53f2c015b05cbc7af9e08ae0d064feb8b69fead

Observation 51016bb6-ed26-4228-8ce7-e2a0cf89d0a7 · outbound

This paper cites Universal Checkpointing: A Flexible and Efficient Distributed Checkpointing System for Large-Scale DNN Training with Reconfigurable Parallelis.

YuLan-Mini: An Open Data-efficient Language Model Universal Checkpointing: A Flexible and Efficient Distributed Checkpointing System for Large-Scale DNN Training with Reconfigurable Parallelis

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.713062Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.713062Z digest=sha256:3bddaea462bc91dce049867ef79e440e2d42e4a3045fd8d69b05a7cc6fd57889

Observation 71a195d8-08d9-429f-856f-f4e36eb3087e · outbound

This paper cites Let's verify step by step.

YuLan-Mini: An Open Data-efficient Language Model Let's verify step by step

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.717656Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.717656Z digest=sha256:0f22a77536d53574335ee11eca7246246811050f4ff949e3d12ab993882726bf

Observation 1d46ae2a-a2eb-42c1-9a4c-6d00d8b3d451 · outbound

This paper cites Lean-STaR: Learning to Interleave Thinking and Proving.

YuLan-Mini: An Open Data-efficient Language Model Lean-STaR: Learning to Interleave Thinking and Proving

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.721451Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.721451Z digest=sha256:bdf5f98ad1edbcf85c677e04812c440c3e3933556a12543e930ef350415ac176

Observation a0730987-ad22-477c-91cb-3dd1f406fe4b · outbound

This paper cites Evaluating language models for efficient code generation.

YuLan-Mini: An Open Data-efficient Language Model Evaluating language models for efficient code generation

Reference 61

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.725736Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.725736Z digest=sha256:57f82bb2ee3dc5078b827cd75123ef1382871d71f8b26bcd88c519d3b2bd6507

Observation 332f812f-14f7-49cc-8a0b-bc98b5b1a394 · outbound

This paper cites Longwanjuan: Towards systematic measurement for long text quality.

YuLan-Mini: An Open Data-efficient Language Model Longwanjuan: Towards systematic measurement for long text quality

Reference 62

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.729586Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.729586Z digest=sha256:e772564e3f23f95788b43096f95fbe063849a7ad96fdb03797e966f8c2458904

Observation 372b526d-e9d4-499b-822f-e2b8c5ae2fc2 · outbound

This paper cites Iandola, Chen Lai, Yuandong Tian, Igor Fedorov, Yunyang Xiong, Ernie Chang, Yangyang Shi, Raghuraman Krishnamoorthi, Liangzhen Lai, and Vikas Chandra.

YuLan-Mini: An Open Data-efficient Language Model Iandola, Chen Lai, Yuandong Tian, Igor Fedorov, Yunyang Xiong, Ernie Chang, Yangyang Shi, Raghuraman Krishnamoorthi, Liangzhen Lai, and Vikas Chandra

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.733247Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.733247Z digest=sha256:7ff2e7003afd6680a7bf7e97f5b8961213f866d945656f31ee157d36297edfdb

Observation 29198369-d345-492c-8104-5ef371e61085 · outbound

This paper cites Decoupled weight decay regularization.

YuLan-Mini: An Open Data-efficient Language Model Decoupled weight decay regularization

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.736619Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.736619Z digest=sha256:39b6c5054dce6f690b747e84ccb29876531b964d8f6ac32a49f54c05325dd065

Observation 0a8a1e71-1888-423c-b010-e3f41b4cfb23 · outbound

This paper cites Fineweb-edu, May 2024 a.

YuLan-Mini: An Open Data-efficient Language Model Fineweb-edu, May 2024 a

Reference 65

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.740267Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.740267Z digest=sha256:abf7d2c6c70e19062d0c3a21d520a691bc667de6c4127cb85b4d3ee8724b8b7b

Observation ffbab978-eb00-4886-9b1e-9fa502d20b1e · outbound

This paper cites StarCoder 2 and The Stack v2: The Next Generation.

YuLan-Mini: An Open Data-efficient Language Model StarCoder 2 and The Stack v2: The Next Generation

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.743567Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.743567Z digest=sha256:2413e12bcf07d3cb28bfd5748433e98f41d3278ebc2d932b811a009ef6e59b93

Observation e265e353-5c69-4eb7-8f90-70c410304222 · outbound

This paper cites \# instag: Instruction tagging for analyzing supervised fine-tuning of large language models.

YuLan-Mini: An Open Data-efficient Language Model \# instag: Instruction tagging for analyzing supervised fine-tuning of large language models

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.747649Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.747649Z digest=sha256:fae4f2e1e7abdc6270bbe8e5d893bdad00abe8f67376d5c7d441a21f9fbadedc

Observation ada51368-6dfe-4c1f-85d8-d15a3b00a4aa · outbound

This paper cites Gemma: Open Models Based on Gemini Research and Technology.

YuLan-Mini: An Open Data-efficient Language Model Gemma: Open Models Based on Gemini Research and Technology

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.751805Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.751805Z digest=sha256:26d34bb4924afae08a5e3d8c9937ed7165435976831a8d2a6022a49c39b0fa27

Observation 7682d8df-fb4c-48ac-9114-8ad3e7336eb1 · outbound

This paper cites Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems.

YuLan-Mini: An Open Data-efficient Language Model Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.755485Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.755485Z digest=sha256:89a89e00e2cbb79d5708be1194afae232d00aadd66d0fa4ecaeaa246877c01b4

Observation 2888ad4e-50be-48ba-990a-1fe349f00bc8 · outbound

This paper cites AgentInstruct: Toward Generative Teaching with Agentic Flows.

YuLan-Mini: An Open Data-efficient Language Model AgentInstruct: Toward Generative Teaching with Agentic Flows

Reference 70

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.759885Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.759885Z digest=sha256:21a81b61b4ea2bfec8ff015c1732dc7f5d60aedcb077fbdadcb290b059372c46

Observation 20006ad7-ff15-436b-b12c-742bebf742df · outbound

This paper cites Orca-Math: Unlocking the potential of SLMs in Grade School Math.

YuLan-Mini: An Open Data-efficient Language Model Orca-Math: Unlocking the potential of SLMs in Grade School Math

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.764251Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.764251Z digest=sha256:6fc3e7d08a525cb927b2b3e7c3eed0addab2d28694246ff6900fdc9d0e96bb6c

Observation c86fb826-818e-46aa-bd8a-a26fc2b0a430 · outbound

This paper cites A Theory on Adam Instability in Large-Scale Machine Learning.

YuLan-Mini: An Open Data-efficient Language Model A Theory on Adam Instability in Large-Scale Machine Learning

Reference 72

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.769456Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.769456Z digest=sha256:ea948045b675bc28ba0957deb97d82815ed815663ff8ac8fb8eff31c7dc7d36d

Observation 20a028e5-506a-4f8a-b8b4-3fe06c836d58 · outbound

This paper cites A Corpus and Evaluation Framework for Deeper Understanding of Commonsense Stories.

YuLan-Mini: An Open Data-efficient Language Model A Corpus and Evaluation Framework for Deeper Understanding of Commonsense Stories

Reference 73

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.775045Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.775045Z digest=sha256:258a9fe2944ab88cf121c2e3813dbe9ea75c5a66d93a001af732533342d6eef0

Observation 37f381ee-a220-45c8-b701-6757e7e54e4d · outbound

This paper cites Initialization of large language models via reparameterization to mitigate loss spikes.

YuLan-Mini: An Open Data-efficient Language Model Initialization of large language models via reparameterization to mitigate loss spikes

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.779633Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.779633Z digest=sha256:7d8bf973dba447f400e7fd3134e0c5d536bb6a5cc3de633f249995151bf14d7c

Observation 0d427be1-5e49-4c7f-8999-73dec0ad5d7b · outbound

This paper cites GPT-4 Technical Report.

YuLan-Mini: An Open Data-efficient Language Model GPT-4 Technical Report

Reference 75

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.783357Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.783357Z digest=sha256:f92d524d6952471fef804f67d3fabf3417b2f5bf08823b8211a10415ca391602

Observation 1a62bfcc-d9f6-461c-8325-421f6c18c33f · outbound

This paper cites Opencsg/chinese-fineweb-edu Datasets at Hugging Face.

YuLan-Mini: An Open Data-efficient Language Model Opencsg/chinese-fineweb-edu Datasets at Hugging Face

Reference 76

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.788805Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.788805Z digest=sha256:6e5dd82426c981d7a0298589a249c29077a6f0938209622c70c1be6665668cd9

Observation 4025dfc6-5705-4989-93c8-9e057f581fd7 · outbound

This paper cites Openwebmath: An open dataset of high-quality mathematical web text.

YuLan-Mini: An Open Data-efficient Language Model Openwebmath: An open dataset of high-quality mathematical web text

Reference 77

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.793062Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.793062Z digest=sha256:175c6dcee816ed21cb922c9dbeae8ea423dc820a5d7012dedf114c8f35e56353

Observation 8c045feb-349f-4345-b277-87987db0101a · outbound

This paper cites The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale.

YuLan-Mini: An Open Data-efficient Language Model The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale

Reference 78

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.796851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.796851Z digest=sha256:32b56f642740c7bde133c5b649fdd0cec17bb5a0eaaa5a63fbe52a5a3a462425

Observation b96506b3-2dd9-4ed0-9312-32ccf87930ef · outbound

This paper cites Using the output embedding to improve language models.

YuLan-Mini: An Open Data-efficient Language Model Using the output embedding to improve language models

Reference 79

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.800922Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.800922Z digest=sha256:a47e896a942c45f326be3eb5c13469176a0f500eec830fa76a9798b410d07966

Observation fb3f90b6-cd61-48ce-88a9-3167d0f6cd56 · outbound

This paper cites Bpe-dropout: Simple and effective subword regularization.

YuLan-Mini: An Open Data-efficient Language Model Bpe-dropout: Simple and effective subword regularization

Reference 80

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.805088Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.805088Z digest=sha256:f8e9f4b483eaeb92cf36b34dc8616642eb238d7240d73f25b71037a88972496d

Observation dfd598b5-840e-401e-aea0-b701e6d112d4 · outbound

This paper cites Qwen2.5: A party of foundation models, September 2024.

YuLan-Mini: An Open Data-efficient Language Model Qwen2.5: A party of foundation models, September 2024

Reference 81

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.809849Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.809849Z digest=sha256:5ae07ea226f2741ff6555fc241ae37f74ff10de6cac59915d39c1466ac7b4d52

Observation cbb74a3b-c0d6-4000-9465-ace5f2b438af · outbound

This paper cites Qwq: Reflect deeply on the boundaries of the unknown, November 2024.

YuLan-Mini: An Open Data-efficient Language Model Qwq: Reflect deeply on the boundaries of the unknown, November 2024

Reference 82

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.813910Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.813910Z digest=sha256:d219a9eac75b3c0d363a1fb72ebdd40a6b062612500892f60190ed7e17c2da86

Observation 11a5e7c4-1136-4352-8252-4ef5e130d539 · outbound

This paper cites Generalized Slow Roll for Tensors.

YuLan-Mini: An Open Data-efficient Language Model Generalized Slow Roll for Tensors

Reference 83

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.818112Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.818112Z digest=sha256:04dff7fa3642c82fff262516c9145606de1048b229310975631ca0242323e550

Observation 98d016bd-757e-40a0-bc69-5d86bb7d5913 · outbound

This paper cites Methods of improving LLM training stability.

YuLan-Mini: An Open Data-efficient Language Model Methods of improving LLM training stability

Reference 84

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.822498Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.822498Z digest=sha256:cb73fae5523aeb35ef13b9ca3e1bc6dc22c81c77ddf39142ffe0efa8bc68a426

Observation 15560fa9-2c6a-46c7-85fa-55bd7bea687f · outbound

This paper cites Winogrande: an adversarial winograd schema challenge at scale.

YuLan-Mini: An Open Data-efficient Language Model Winogrande: an adversarial winograd schema challenge at scale

Reference 85

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.826872Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.826872Z digest=sha256:faf089e244716b80dcd6fe50767ae8081921c21a34352623f0e0274fa2889c17

Observation 309525be-37af-4878-aa69-f0beef33a369 · outbound

This paper cites Analysing mathematical reasoning abilities of neural models.

YuLan-Mini: An Open Data-efficient Language Model Analysing mathematical reasoning abilities of neural models

Reference 86

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.830356Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.830356Z digest=sha256:4972d4bd8ab552826c9946b79888c8d495e4b9b646989e2d19aeaa73f076262a

Observation dd4fec3b-5f25-4c4d-860d-e6cf23ba19dc · outbound

This paper cites What Language Model to Train if You Have One Million GPU Hours?.

YuLan-Mini: An Open Data-efficient Language Model What Language Model to Train if You Have One Million GPU Hours?

Reference 87

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.834003Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.834003Z digest=sha256:2e4ea01ec42d7766606b3d29bb3e3ead4a440ac3b141b3a3931239827093d9bd

Observation 50587157-1d42-495a-8d07-2e0c299bd7b7 · outbound

This paper cites GLU Variants Improve Transformer.

YuLan-Mini: An Open Data-efficient Language Model GLU Variants Improve Transformer

Reference 88

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.837609Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.837609Z digest=sha256:780b0dfbdeece1a8b7e303dfe364ad191af6542d85726560d4c82f5082eb7cd6

Observation 8730c3b9-df50-4f55-9cd3-42ff5cae83c1 · outbound

This paper cites Reflexion: language agents with verbal reinforcement learning.

YuLan-Mini: An Open Data-efficient Language Model Reflexion: language agents with verbal reinforcement learning

Reference 89

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.841726Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.841726Z digest=sha256:7983cad42c75e7afe19cdaed2bc12ed400aca7c61c28eeb7c21e8fbb20bc5b99

Observation 49a2a1f1-c421-43ed-bf83-eeefaf70a699 · outbound

This paper cites Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism.

YuLan-Mini: An Open Data-efficient Language Model Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism

Reference 90

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.845648Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.845648Z digest=sha256:19de3a355d3d069a25fdacb20ad2977c0ae455d7bcf9cb63e112a26bc8bd96fa

Observation 534693d8-74e2-48b1-87d9-c6c9ce775baa · outbound

This paper cites Scaling synthetic logical reasoning datasets with context-sensitive declarative grammars.

YuLan-Mini: An Open Data-efficient Language Model Scaling synthetic logical reasoning datasets with context-sensitive declarative grammars

Reference 91

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.850860Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.850860Z digest=sha256:36b056eae9938172753ff3c95a6660ffa0e2a6b00e734202caa33ccf9e5d00e8

Observation b8249ded-ee17-4de7-b738-8b9f07ef0f4b · outbound

This paper cites Peters, Abhilasha Ravichander, Kyle Richardson, Zejiang Shen, Emma Strubell, Nishant Subramani, Oyvind Tafjord, Pete Walsh, Luke Zettlemoyer, Noah A.

YuLan-Mini: An Open Data-efficient Language Model Peters, Abhilasha Ravichander, Kyle Richardson, Zejiang Shen, Emma Strubell, Nishant Subramani, Oyvind Tafjord, Pete Walsh, Luke Zettlemoyer, Noah A

Reference 92

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.855080Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.855080Z digest=sha256:2864df0577e4f5f4436f5aafb5334b2b8cb77f764e07ecc9a775d1baeb0032e7

Observation 067a34e9-01f5-4deb-ad99-eaf1f3bd5113 · outbound

This paper cites An integrated data processing framework for pretraining foundation models.

YuLan-Mini: An Open Data-efficient Language Model An integrated data processing framework for pretraining foundation models

Reference 93

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.859191Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.859191Z digest=sha256:e18291402d6403222783f1f23f4d2da574850549a72090245cf6d9876a2db736

Observation ebafdae7-2f71-4a6e-8c3a-b718eab9b0c1 · outbound

This paper cites Spike No More: Stabilizing the Pre-training of Large Language Models.

YuLan-Mini: An Open Data-efficient Language Model Spike No More: Stabilizing the Pre-training of Large Language Models

Reference 94

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.863452Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.863452Z digest=sha256:0b92d2fa25cbe4ec6bc712b9ad5c4cb8a56cee60d5ca305200ab53cc56202354

Observation f6830659-a783-475b-91fb-768d22f64b1c · outbound

This paper cites an unresolved cited work.

YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work

Reference 95

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.868198Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.868198Z digest=sha256:90c93979423729f5e181911a233ff6c99d7094101477cb4332ae1b4456ab5e11

Observation f0a4b540-0312-49a1-8aa8-e20ccd484eff · outbound

This paper cites LLMBox : A Comprehensive Library for Large Language Models.

YuLan-Mini: An Open Data-efficient Language Model LLMBox : A Comprehensive Library for Large Language Models

Reference 96

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.872360Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.872360Z digest=sha256:8edaf5b1c5d4240793cdc14f8a0afb3c8d3f46ab0ae9279eee1e912c737d626d

Observation b99b19bd-383b-440d-bc06-50cc5082675c · outbound

This paper cites Mathscale: Scaling instruction tuning for mathematical reasoning.

YuLan-Mini: An Open Data-efficient Language Model Mathscale: Scaling instruction tuning for mathematical reasoning

Reference 97

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.877674Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.877674Z digest=sha256:71cf1248a8d2b982f3858565ed99413fcd998bc1b786c73b5b0f5f4f2bf31c6a

Observation 2e309652-293c-493e-8eba-e2a1cf5f4941 · outbound

This paper cites an unresolved cited work.

YuLan-Mini: An Open Data-efficient Language Model Unresolved cited work

Reference 98

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.881542Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.881542Z digest=sha256:523f32e9617e40212ae22ea891b1914bb7090e7f8e9d836b2b862d5da2060763

Observation d2abf91c-b95f-4497-b093-4e5a31d32053 · outbound

This paper cites D4: improving LLM pretraining via document de-duplication and diversification.

YuLan-Mini: An Open Data-efficient Language Model D4: improving LLM pretraining via document de-duplication and diversification

Reference 99

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.885313Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.885313Z digest=sha256:e40b199ace06571c51e48bb29d7d5a37902eeaf68657daf290f2467e6df75fec

Observation 743e5dc6-35c4-4390-8c15-ea78498a6d02 · outbound

This paper cites Scaling Law with Learning Rate Annealing.

YuLan-Mini: An Open Data-efficient Language Model Scaling Law with Learning Rate Annealing

Reference 100

Resolution
unresolved
no resolver link, observed 2026-08-11T05:17:55.889322Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T05:17:55.889322Z digest=sha256:7a492b4b9b7d985bc8be556386b68084a8b3eb5bdf2cf99d2e38f67647548cda

Pith citing papers

Observation 0f838f95-5254-4696-9768-1be08b293133 · inbound

Falcon-H1: A Family of Hybrid-Head Language Models Redefining Efficiency and Performance cites this paper.

Falcon-H1: A Family of Hybrid-Head Language Models Redefining Efficiency and Performance YuLan-Mini: An Open Data-efficient Language Model

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-06T11:44:04.984553Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T11:44:04.984553Z digest=sha256:78202dd851eca8906f9436cf6efc997b7c623831132491e4ae4451ca1cb8d175

Observation bdd60ec4-fc6d-4569-bebe-949dfecc6068 · inbound

Towards Efficient LLMs Annealing with Principled Sample Selection cites this paper.

Towards Efficient LLMs Annealing with Principled Sample Selection YuLan-Mini: An Open Data-efficient Language Model

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-06-28T22:42:47.027667Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.

source=pdf_text observed=2026-06-28T22:36:28.889515Z digest=sha256:01a0ce7529d9065994679c680ff20dd239695dd355835114aa958500869cb804