Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-07T14:11:32.239612Z
Paper Citation Record · LEDGER
As of 8 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2505.19743.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-07T14:11:32.239612Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links
A source-named dated measurement, never combined with another source.
Source: cited_works
32 of 32 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation 6d6a5bcf-1410-499e-9bee-80e9ba2d008d · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Llama 3 model card
Reference 1
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 6604e4c7-4876-4fbf-a6c5-4753b52ba655 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Foundational Challenges in Assuring Alignment and Safety of Large Language Models
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 897d858c-ec8d-4902-a479-ad3454ca6d16 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models A general theo- retical paradigm to understand learning from human pref- erences
Reference 4
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 04fc6024-8a07-4f7e-bf80-f3e477e26742 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback
Reference 5
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1d45dbd4-4bca-4e1b-ba73-570d344eedba · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 855cb21f-ee1f-4a9c-a45b-59058a3e097e · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Safe rlhf: Safe reinforcement learning from human feedback
Reference 9
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 589885e6-e3ec-489e-9626-de2308e31c5a · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Raft: Reward ranked finetuning for generative foundation model alignment
Reference 10
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 39000e2c-02cc-43e3-bb45-c39de069dde3 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Helping or Herding? Reward Model Ensembles Mitigate but do not Eliminate Reward Hacking
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ae7fcb4f-528c-4d01-ac0c-f6371d9b54c0 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5f05f867-ff0e-4065-8f01-bf7651d187a3 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference
Reference 13
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1bdf83ab-21be-4bb7-9887-959928d07895 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Mistral 7B
Reference 14
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation a0ebabd2-5a2f-4c99-8920-e91a99b028b2 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Dynamic context selection for document-level neural machine translation via rein- forcement learning
Reference 15
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 67459871-29de-46ae-ba2d-8d2545b9a780 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Rain: Your language mod- els can align themselves without finetuning
Reference 17
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation a56194f8-74ef-4bd5-94c0-b158a810ad1d · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models WebGPT: Browser-assisted question-answering with human feedback
Reference 18
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 91c21b9c-92ec-44b9-8eef-10ea4e1495ee · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Discovering language model behaviors with model-written evaluations
Reference 20
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 50bee4c0-563f-436b-b0f4-554b9e7a3a4d · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models From $r$ to $Q^*$: Your Language Model is Secretly a Q-Function
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0a52bf91-962a-46af-be21-be10800abe81 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Self-critiquing models for assisting human evaluators
Reference 22
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation aafe33f8-6e17-4fca-a305-083e30e4be93 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Learning to summarize with human feedback
Reference 23
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 56fc202a-a8ae-4449-9161-221c8110495a · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Llama 2: Open Foundation and Fine-Tuned Chat Models
Reference 24
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fe761636-83cd-4a26-a6ab-06a340bb0116 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Beyond Reverse KL: Generalizing Direct Preference Optimization with Diverse Divergence Constraints
Reference 25
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 821655a1-b7eb-4960-af6c-5269549aa457 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Aligning Large Language Models with Human: A Survey
Reference 26
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 77e94b15-2a06-4775-8896-7597012b38aa · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Recursively Summarizing Books with Human Feedback
Reference 27
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f6cd4066-6ef3-448c-a30e-c0710270a619 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models RRHF: Rank Responses to Align Language Models with Human Feedback without tears
Reference 28
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation dbd60d84-94dd-4028-8a95-c4afe65da5e0 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Token- level direct preference optimization
Reference 29
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation f7819f66-1b75-41c9-ad78-34db3d3a57bc · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Llamafactory: Unified efficient fine- tuning of 100+ language models
Reference 30
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation c4de7e60-b185-4ffc-a5e9-0029ea61649a · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models DPO Meets PPO: Reinforced Token Optimization for RLHF
Reference 31
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7b4deacb-e750-4ada-bfad-fd7e36233812 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Fine-Tuning Language Models from Human Preferences
Reference 32
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 65db4843-36f3-4006-a46d-b49cd14deb8a · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback
Reference 2020
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 11622fac-69f3-4709-a420-7de135f080eb · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Training language models to follow instruc- tions with human feedback
Reference 2021
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation 7300e744-7910-476a-b0be-1e611f510e7c · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Constitutional AI: Harmlessness from AI Feedback
Reference 2022
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 05331e07-6d4b-44e5-a284-a84a0b92d6de · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models Ultrafeedback: Boosting language models with high-quality feedback
Reference 2023
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
Observation b4213521-25c1-4121-b9e0-0c12ca520057 · outbound
Token-level Accept or Reject: A Micro Alignment Approach for Large Language Models aligner/aligner-7b-v1.0 · Hug- ging Face — huggingface.co
Reference 2024
Source-reported events for the cited work
No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.
No inbound Pith citation observations are available.