Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-09T17:09:15.462034Z
Paper Citation Record · LEDGER
As of 14 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 4 inbound Pith citation observations for arXiv:2502.01697.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-09T17:09:15.462034Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links, observed 2026-08-07T15:08:04.002985Z
A source-named dated measurement, never combined with another source.
Source: pith, observed 2026-08-06T01:00:08.633531Z
47 of 47 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation 544ba400-4f9c-4b3f-b138-ba2ac1574724 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation On the Diversity of Synthetic Data and its Impact on Training Large Language Models
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9033d16f-0fe9-4637-94c7-25a5e003a62f · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Increasing Diversity While Maintaining Accuracy: Text Data Generation with Large Language Models and Human Interventions
Reference 2
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bb01b4c7-0fed-4fb4-bd8b-dbe4d0233021 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Training Verifiers to Solve Math Word Problems
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 24d7c184-272a-40fc-858f-7dae6a35eeda · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e5a00fd3-c0a0-4d6f-a07f-4750fa924888 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation The Llama 3 herd of models, 2024
Reference 5
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.
Observation ad28d8ab-fa0d-4b12-8341-b38925a23fed · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Personas with Attitudes: Controlling LLMs for Diverse Data Annotation
Reference 6
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b145b221-3dee-488f-b0c7-06e3d27e9764 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Deliberative Alignment: Reasoning Enables Safer Language Models
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 37eb2a8b-404a-474b-905c-900182f7e63c · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence
Reference 8
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 9e073b28-c120-49c2-aa09-604ca23051cc · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation The Curious Decline of Linguistic Diversity: Training Language Models on Synthetic Text
Reference 9
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a5e414c0-d1da-46b2-8451-bef6e24ef5dc · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation The curious case of neural text degeneration
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4d6b588a-b842-4ea3-bfaa-87aab0bce7c8 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation LoRA: Low-Rank Adaptation of Large Language Models
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4021880c-bfe8-40aa-bc00-681ce0271200 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e6fd6502-d8c3-4308-9d3f-57d2a29e0332 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation PubMedQA: A Dataset for Biomedical Research Question Answering
Reference 13
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 392b8dae-7dae-4db8-aeb6-7a8b287be89b · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation The Enron corpus: A new dataset for email classification research
Reference 14
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e49c82fa-5d36-4c6f-9fad-c2d9e64c57ef · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Self-Directed Synthetic Dialogues and Revisions Technical Report
Reference 15
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.
Observation 7eb51fd3-ac6b-4258-a53e-044a59a13164 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Synthetic Data (Almost) from Scratch: Generalized Instruction Tuning for Language Models
Reference 16
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 25b28f9f-fb3a-4572-a1ac-311991002502 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Predicting vs. Acting: A Trade-off Between World Modeling & Agent Modeling
Reference 17
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c7ff898d-718f-439d-ab05-dd5b082f5231 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Making Large Language Models Better Reasoners with Step-Aware Verifier
Reference 18
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 780c2aa7-08c0-4728-b188-dc22d8566f4a · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Textbooks Are All You Need II: phi-1.5 technical report
Reference 19
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 68491292-2250-48ad-85d4-02cb81a42492 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Best Practices and Lessons Learned on Synthetic Data
Reference 20
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e4375cc6-08b8-4683-b337-991ab3ce7c6b · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Diversity of Thought Improves Reasoning Abilities of LLMs
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 24cc36f4-ac9e-4e94-8c2a-fc5985da2af2 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Sky-T1 : Train your own o1 preview model within \ 450
Reference 22
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.
Observation 901ea479-15ff-4e3d-a9d6-3cb78658daa8 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Nemotron-4 340B Technical Report
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a951b623-fa39-456d-99ed-afa5f09e158f · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation New embedding models and API updates
Reference 24
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.
Observation 0b2b5582-e43e-4314-889f-02f31a2cb24c · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation GPT-4 Technical Report
Reference 25
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 827297e9-ae7d-4882-9975-e36474e612a6 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Hello GPT -4o
Reference 26
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.
Observation 5c76823b-3c36-44d4-8269-757774240fb5 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Gorilla: Large Language Model Connected with Massive APIs
Reference 27
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 458081d4-843f-437b-b421-c7102a78779a · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Pedregosa, G
Reference 28
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.
Observation 702d81d7-265a-4afb-81ee-802c9b5735a3 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Qwen2.5 Technical Report
Reference 29
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e102adaa-4e9b-4eef-9476-d01d69925c11 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Pretraining task diversity and the emergence of non-Bayesian in-context learning for regression
Reference 30
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 68c2e63d-4415-4c43-a7e9-74e78600ec98 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks
Reference 31
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6ffe84fd-eaf0-4e13-921e-e69b834f062a · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts
Reference 32
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 586ef5b8-853c-436a-a23a-623cdbf75e23 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation LLM See, LLM Do: Guiding Data Generation to Target Non-Differentiable Objectives
Reference 33
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 938fd7e5-380d-415a-809f-0ed018152fb8 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Unresolved cited work
Reference 34
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 024b5d0b-e28d-42cb-90e1-4cdb6fe1978f · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Evaluating the evaluation of diversity in natural language generation
Reference 35
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 99900fa9-792c-4c23-ad14-0f4202cec919 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Will we run out of data? Limits of LLM scaling based on human-generated data
Reference 36
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation b9803525-502c-4b40-9174-1a87d9228f96 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Planning In Natural Language Improves LLM Search For Code Generation
Reference 37
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0d142431-7588-4070-b671-6d039be6ea62 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Magicoder: Empowering code generation with OSS -instruct
Reference 38
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.
Observation 104c2e8a-7e1c-4db3-bac6-5a96f0ca35e9 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation SimpleStrat: Diversifying Language Model Generation with Stratification
Reference 39
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.
Observation 2ea13239-fe82-4ffe-836b-95c6ff8c16f1 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation HotpotQA: A Dataset for Diverse, Explainable Multi-hop Question Answering
Reference 40
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 78e7e278-1efe-4c4b-ae27-20f3223f0a22 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models
Reference 41
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0e410b0d-eb4e-495a-828c-567b648cb6d6 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation STaR: Bootstrapping Reasoning With Reasoning
Reference 42
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 8ea1cc25-cc61-439b-a26e-3aa6baf3a731 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Accessing GPT-4 level Mathematical Olympiad Solutions via Monte Carlo Tree Self-refine with LLaMa-3 8B
Reference 43
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 27b82581-9b8d-42d7-8ffd-de5e7d5c7ad4 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Improving diversity of commonsense generation by large language models via in-context learning
Reference 44
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation df241338-3eb9-43d3-ac69-82ad2f9c04cd · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation RAFT: Adapting Language Model to Domain Specific RAG
Reference 45
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 371d0bbb-e1fa-437c-bc2c-84d4e7773a69 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation BERTScore: Evaluating Text Generation with BERT
Reference 46
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation efe1d1fb-afc7-4ee2-a5b4-5d47bcfc09c7 · outbound
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation Texygen: A benchmarking platform for text generation models
Reference 47
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.
Observation 5eac65fc-499a-4ab9-ae64-4d2af8ab00bd · inbound
LongMagpie: A Self-synthesis Method for Generating Large-scale Long-context Instructions BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation
Reference 2019
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 2989eccf-5992-4b4d-b8ae-743be62803b9 · inbound
The Prompt is Mightier than the Example BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation
Reference 45
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ec2af6cb-b8cc-468b-98ec-7dafcabab294 · inbound
Intent Factored Generation: Unleashing the Diversity in Your Language Model BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation
Reference 24
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7d61fdd7-b584-44bd-9dde-c07de86117bf · inbound
Fine-tuning for Better Few Shot Prompting: An Empirical Comparison for Short Answer Grading BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation
Reference 13
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.