Pith. sign in

Paper Citation Record · LEDGER

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

As of 13 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 6 inbound Pith citation observations for arXiv:2502.01126.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.01126 v1

Coverage vector

measured 55 of 55 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-09T16:34:01.216310Z

measured 61 of 61 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-12T06:34:41.77262+00:00

measured 6 of 6 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-06T17:12:11.740039Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-03T18:08:46.660526Z

Reference resolution

55 of 55 outbound references displayed

  • verified exact2
  • verified fuzzy20
  • unresolved33
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 038a8a8a-2c88-40a9-a9ea-9749e2ffe95e · outbound

This paper cites Claude 3.5 Sonnet.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Claude 3.5 Sonnet

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.353051Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.040680Z digest=sha256:2fc0f80b86b4ce19e2a66c7c5726132d2954bf051b20f600ae72d00c5db4c4f6

Observation b62ee666-6b2d-4217-ae83-ad0abd695d9f · outbound

This paper cites an unresolved cited work.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Unresolved cited work

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.044614Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.044614Z digest=sha256:4ecc5efd20bc50abc22bf433cd3af86e71feae158c7a9479d1a4583fc748cea7

Observation e509e91f-eca9-494a-ab27-11b4242163d4 · outbound

This paper cites Constitutional AI: Harmlessness from AI Feedback.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Constitutional AI: Harmlessness from AI Feedback

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.048322Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.048322Z digest=sha256:a956d6c0bcca7c2ef6e9c23bbb92d82ee499812a4f98e9fbed9bd49dc9ce537a

Observation 8d4c0e2e-7db0-4283-abd4-d9c69e4036ff · outbound

This paper cites an unresolved cited work.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Unresolved cited work

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.052216Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.052216Z digest=sha256:e92159a0adcba6aa2191d7d538526c58eefc5c953c7b070df307aa13f4392fbb

Observation dd974ade-36e1-4551-b740-d9bc4a07e3e4 · outbound

This paper cites Deep reinforcement learning from human preferences.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Deep reinforcement learning from human preferences

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.055766Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.055766Z digest=sha256:0eb0e2df9ac6d780bc222e4fe74543a310ff1a8c753e727ca873d67e352fd2aa

Observation 08ee4562-d1ac-4077-96c6-ba8fcb222618 · outbound

This paper cites DeGroot and Stephen E.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences DeGroot and Stephen E

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.336942Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.059492Z digest=sha256:eda7e356d04261b5fd1b0a176201b99239204652d9c45a851ea396bd536eae20

Observation c20c354f-7fac-4b5d-bcd9-8fce50d63381 · outbound

This paper cites The Llama 3 Herd of Models.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences The Llama 3 Herd of Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.062909Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.062909Z digest=sha256:675b9c4b184781bae2b7966b587a25bf0b3a340bb82f219bb785484ad811f2f6

Observation 5bab9d77-0b27-4b7b-b112-dc3b5792b670 · outbound

This paper cites Sivakumar.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Sivakumar

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.327066Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.066290Z digest=sha256:e9b5192cc027c14eca2695da7405fec2e1ac676e79de8e106918c7abadf208ec

Observation 25bb767f-3e02-4c55-a6fd-94ae2ecbea01 · outbound

This paper cites On the foundations of noise-free selective classification.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences On the foundations of noise-free selective classification

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.317442Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.069315Z digest=sha256:bbd6a28f2b1a253abef118c71b69566d54594c061631d3437a433a027eaaa130

Observation 96c38c8d-dad7-473d-8026-6f82bf3b170c · outbound

This paper cites The Rating of Chessplayers, Past and Present.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences The Rating of Chessplayers, Past and Present

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.072264Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.072264Z digest=sha256:8916a5b273f9f55289bb213d359b174a4df27ddfd9ebc2d33d84d87d66248e94

Observation 9ae8e036-984d-401d-bdb6-f64009ff1e13 · outbound

This paper cites KTO: Model Alignment as Prospect Theoretic Optimization.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences KTO: Model Alignment as Prospect Theoretic Optimization

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.078869Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.078869Z digest=sha256:7ad915a6f1524c8b03ee5d1cdd335653083451542130dc00492f697b8867cc87

Observation 9aa76400-b106-48be-b37c-9b7786440684 · outbound

This paper cites Selective prediction-set models with coverage guarantees.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Selective prediction-set models with coverage guarantees

Reference 12

Resolution
verified exact
local_arxiv, observed 2026-08-09T16:34:01.759266Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.082725Z digest=sha256:63f911d0bcef91172cb7233fd32e53ce49ea5d84ba398a3ea9177f750b219483

Observation 84c0728d-b3a4-4b59-9740-b39a87669bfe · outbound

This paper cites Gptscore: Evaluate as you desire.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Gptscore: Evaluate as you desire

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.307483Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.086497Z digest=sha256:3d2129b275373e9a293556f6e39478aadd810806e9bf1ce43db1e2e18531e9a4

Observation 3feebc79-0d96-458c-95dd-9bf0520e9029 · outbound

This paper cites On Calibration of Modern Neural Networks.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences On Calibration of Modern Neural Networks

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.089663Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.089663Z digest=sha256:3f025c51a66bd7f11604d720468f72364da1e6b007de70c88278bb8ae721f218

Observation eec04e32-23a9-4e57-bff1-806039ae5465 · outbound

This paper cites Weinberger.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Weinberger

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.297820Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.093138Z digest=sha256:79cc3eafe5217f4f7a2bbf9c0003a4bc3f40a19dadc753e6dc644f630d1905de

Observation 1b1f8248-2013-4fe3-b151-4b20f7fdf2c7 · outbound

This paper cites A baseline for detecting misclassified and out-of-distribution examples in neural networks.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences A baseline for detecting misclassified and out-of-distribution examples in neural networks

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.096221Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.096221Z digest=sha256:ad7135585f45d8a4e9d8c3ab69a6c6dec9a8257df20df1229d9522b9e9edc399

Observation 24e92e21-8248-4067-b93c-ffb1897ae9a2 · outbound

This paper cites Measuring massive multitask language understanding.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Measuring massive multitask language understanding

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.282327Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.099247Z digest=sha256:c53cf493026b9bf64ef0f484a195410c7eb4cff8a0922698b219117cb6ee0402

Observation 8f8a93b4-2247-4cdd-9bfd-ceab9fcf0f74 · outbound

This paper cites Measuring Mathematical Problem Solving With the MATH Dataset.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Measuring Mathematical Problem Solving With the MATH Dataset

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.102298Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.102298Z digest=sha256:b0679adba39c2bc8852f86937da35c911ab6d13738b504c3ef6fdd3e07edb6bb

Observation 7598ce1d-e0dd-466c-8826-c37ce81c98b7 · outbound

This paper cites Minka, and Thore Graepel.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Minka, and Thore Graepel

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.272584Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.105681Z digest=sha256:990ae83d65d2756d3e878a2d589050419edd70f549e671b6588c9e805ccca031

Observation ff0b0cc7-f982-4dc0-999b-8b60016070d5 · outbound

This paper cites What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.108285Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.108285Z digest=sha256:8cb687cf59f3434355597a5371e1552e567c2ae4c8bf598b471e028c75f6042f

Observation 8b5e1787-7bf2-43de-94cf-8f1335f3d6f1 · outbound

This paper cites Selective classification can magnify disparities across groups.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Selective classification can magnify disparities across groups

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.262978Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.111175Z digest=sha256:0553143e5ec7eb4e51d49ba5a3c2e9bfa9b1755ca88c9cdd9c3ec854778c628b

Observation 6c3ee263-67cd-451d-8919-8526caca3851 · outbound

This paper cites Language models (mostly) know what they know, 2022.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Language models (mostly) know what they know, 2022

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.114327Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.114327Z digest=sha256:be3459e9e7c9a2af6ae44e9ee39645222e608131d6c5bc7fc2cd7401ef953749

Observation 214b97c4-088e-4703-9659-0bf53bcb0b76 · outbound

This paper cites Kemeny and J.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Kemeny and J

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.117257Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.117257Z digest=sha256:14ea7b2f755fb3dbf1261f4ed58bd79f2e4cb9d19da16dfe781855732abfbf14

Observation 835eca9d-2993-4d03-97c4-b2cf7246dd56 · outbound

This paper cites Unanimous prediction for 100\ In Association for Computational Linguistics (ACL), 2016.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Unanimous prediction for 100\ In Association for Computational Linguistics (ACL), 2016

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.247076Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.119947Z digest=sha256:b2f1d6b1867f91656be62cca6c14fe8c566be594ffc18f554255382af6063522

Observation 06999197-03dc-4598-b2eb-405ce3fdcf68 · outbound

This paper cites Holistic Evaluation of Language Models.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Holistic Evaluation of Language Models

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.122641Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.122641Z digest=sha256:d9ccef81cb1ec496b32b4a9fdb8baa17ac28b2813890753d60a394d64a4de20a

Observation 8d5cf93c-90ee-401f-8f68-ed55cd51c49c · outbound

This paper cites TruthfulQA: Measuring How Models Mimic Human Falsehoods.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences TruthfulQA: Measuring How Models Mimic Human Falsehoods

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.125363Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.125363Z digest=sha256:e8cf05b58c3e58ec387ac7aa56a01d1fd1b028ffa517d39b1de3c2cf48d37f84

Observation 03507724-f635-4e18-9ef5-b3ed1d0d7dcf · outbound

This paper cites Teaching models to express their uncertainty in words.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Teaching models to express their uncertainty in words

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.128934Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.128934Z digest=sha256:75d44eb22c0caf66be33f3a5a8c4001f6e1f353593ae93bfa26665be92a1df9b

Observation c6e9c625-e1fd-46bd-b41a-cfe9d4556419 · outbound

This paper cites Self-Refine: Iterative Refinement with Self-Feedback.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Self-Refine: Iterative Refinement with Self-Feedback

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.131879Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.131879Z digest=sha256:fd92cd8dd13e640698ec1634392588ded0ed0fba30f6e658a91c4efc09940f02

Observation fc686808-1158-4955-a2a4-f7374a987631 · outbound

This paper cites Can a suit of armor conduct electricity? a new dataset for open book question answering.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Can a suit of armor conduct electricity? a new dataset for open book question answering

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.230402Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.135067Z digest=sha256:6cce5d9a586c8c92b0c82f0764ff8045e976ca8b8c3b4d3d2569a3cf12947669

Observation 61d12a34-b748-494d-b47d-10e35f762cbe · outbound

This paper cites Murphy and Robert L.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Murphy and Robert L

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.220422Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.138224Z digest=sha256:2dcc4c3c86144031e1d86a7cb5fe26b6c916b1a2596bc2e2c0605bab21fb3dc5

Observation 4bf1fa61-233e-4c5e-9403-b6c7626adde1 · outbound

This paper cites Cooper, and Milos Hauskrecht.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Cooper, and Milos Hauskrecht

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.210087Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.141299Z digest=sha256:f6975fc1c7b1be29e3f836b0b3bacb1e2c663e4a35a72f78af052c4ec8bac9f0

Observation 809fcde4-914b-4aae-a4e7-5740952b6dc1 · outbound

This paper cites Cooper, and Milos Hauskrecht.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Cooper, and Milos Hauskrecht

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.200526Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.144307Z digest=sha256:c950023dc86bd3aba981829eec18aa1e688175327519d29cf1a16b7b62e9bcbd

Observation fb0ad1e6-d1d5-4f90-a3a8-d037c20bf836 · outbound

This paper cites Negahban, Sewoong Oh, and Devavrat Shah.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Negahban, Sewoong Oh, and Devavrat Shah

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.190942Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.147483Z digest=sha256:d2edbb09cb034e98eeeee40b0a454a0b788206fd79e876dc01616e19a8c9711c

Observation c8371c9a-25c4-4a57-9b5f-6d07069b7ca9 · outbound

This paper cites Introducing chatgpt.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Introducing chatgpt

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.180830Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.150539Z digest=sha256:e690851247ca2b4f51c052e43238c98c106cc50531adfa86e7a9cb05a0af476d

Observation 1eba87ca-a0ff-4536-913c-2e85d49ef04f · outbound

This paper cites an unresolved cited work.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Unresolved cited work

Reference 35

Resolution
unresolved
raw_fallback, observed 2026-08-09T16:34:02.170988Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.153861Z digest=sha256:d7a1d3608e6ed71d2dee40a7bb843556032b4c3ac0f34ea5e4356b86cb3b7cb7

Observation b6fe4d77-bb6e-438c-9d33-5bfba0793266 · outbound

This paper cites an unresolved cited work.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Unresolved cited work

Reference 36

Resolution
unresolved
raw_fallback, observed 2026-08-09T16:34:02.160560Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.156787Z digest=sha256:a4945352e2f3be38872ab732ac2c0f0d998b780c926d8b0c154c2b499b80fa55

Observation c2980b56-f760-43b1-8d41-0216320d50f9 · outbound

This paper cites Training language models to follow instructions with human feedback.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Training language models to follow instructions with human feedback

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.159841Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.159841Z digest=sha256:1980132781d6d618a340419ffd73c0a4b3f634571936000b8ce072c2bdf1b351

Observation 14675387-9817-4f41-8561-634655389597 · outbound

This paper cites The pagerank citation ranking : Bringing order to the web.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences The pagerank citation ranking : Bringing order to the web

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.150163Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.163222Z digest=sha256:726f84dd2e04394aec21b67eb4eb3ec569046570d93e957d0c85ce90425974a0

Observation ccdef85f-4f49-4f33-99bc-d43929110c23 · outbound

This paper cites Direct Preference Optimization: Your Language Model is Secretly a Reward Model.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Direct Preference Optimization: Your Language Model is Secretly a Reward Model

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.166117Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.166117Z digest=sha256:e8fb8db7801d95bc6a0fcc2182fbb552767999a62dfbac5c7305ea8351d5b719

Observation 6cc7a1ab-0bfa-456e-84d3-9794834aace5 · outbound

This paper cites GPQA: A Graduate-Level Google-Proof Q&A Benchmark.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences GPQA: A Graduate-Level Google-Proof Q&A Benchmark

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.169386Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.169386Z digest=sha256:84d7a11b042fc16aa9d780d7b3d83a58d218c0db21e4991e282193f458b33604

Observation 61db9865-fe90-4a1d-92a6-3fc53e1f211a · outbound

This paper cites SocialIQA: Commonsense Reasoning about Social Interactions.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences SocialIQA: Commonsense Reasoning about Social Interactions

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.172731Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.172731Z digest=sha256:d623a437e2094eaad2082c87f37e1bd84b948647a62cd08a352877e365ec9c8b

Observation 1b190f9c-eaa6-47a0-9b53-f2eb4ebbd08e · outbound

This paper cites Llamas Know What GPTs Don't Show: Surrogate Models for Confidence Estimation.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Llamas Know What GPTs Don't Show: Surrogate Models for Confidence Estimation

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.176258Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.176258Z digest=sha256:5fe59342836626f14793f574ae282a49b69ebaea3cfd627f0fc96bf041b7e287

Observation 5f533e8a-e0eb-49b3-b257-28eb7152f05d · outbound

This paper cites Commonsenseqa: A question answering challenge targeting commonsense knowledge.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Commonsenseqa: A question answering challenge targeting commonsense knowledge

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.140002Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.179834Z digest=sha256:f790bd33081fb90ad22d8eeec69fe9b3dbdd0cb827d605bb206b477e7a604fe4

Observation 2124298d-b595-4338-a9f5-e0e5259c4e55 · outbound

This paper cites Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.182852Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.182852Z digest=sha256:aa09adeb8446e0d7a4570bc43d3f34c21eb08cfe4500dee1c6cc230c5e9660ef

Observation 65bf4de6-e9e0-4442-8bd8-c5423652d08f · outbound

This paper cites Fine-tuning Language Models for Factuality.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Fine-tuning Language Models for Factuality

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.186499Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.186499Z digest=sha256:a1598c7c185166d5e9aca2bafa38827724955430e53421901614c3e0dffdb444

Observation c6f56a58-80d5-4552-824c-d62dbe82c527 · outbound

This paper cites Nicolaus Tideman.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Nicolaus Tideman

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.129491Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.189808Z digest=sha256:a72ad1a76f3cdbc6270a3c1f73cea1ea7af457f19ac2a766e67321b919762cc2

Observation 395bdfd9-87ea-469d-be88-b663e9bbf964 · outbound

This paper cites Minimum weighted feedback arc sets for ranking from pairwise comparisons.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Minimum weighted feedback arc sets for ranking from pairwise comparisons

Reference 47

Resolution
verified exact
arxiv_id, observed 2026-08-09T16:34:01.493854Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.192801Z digest=sha256:021354e02893f640a21d88a9151e4b446f8c27ab87a5017eb905b89e40f44df4

Observation 675fb41e-9d80-45c8-8a65-7ea8e7942630 · outbound

This paper cites Self-Consistency Improves Chain of Thought Reasoning in Language Models.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Self-Consistency Improves Chain of Thought Reasoning in Language Models

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.195288Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.195288Z digest=sha256:aae58fe0ba77365ccd1945addb0e667239f708063525b429b13ddda90d40ec7b

Observation fa845f90-2b3f-44b0-979b-8234e270609e · outbound

This paper cites Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.198146Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.198146Z digest=sha256:b1325ea91bef13469cf7bf36407b831c1fa365abf9163caaa4290eb110a6ecf9

Observation 9b626cbf-2f47-49aa-982f-bf923d01ef5c · outbound

This paper cites Tree of Thoughts: Deliberate Problem Solving with Large Language Models.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Tree of Thoughts: Deliberate Problem Solving with Large Language Models

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.200844Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.200844Z digest=sha256:c99ca75735c748ec14eeab2ca8709a121523d021b777f3fdec72d9735a67436d

Observation 56b68cfa-eb5d-43fe-8c34-ae891a55b512 · outbound

This paper cites Self-Rewarding Language Models.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Self-Rewarding Language Models

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.203730Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.203730Z digest=sha256:12dba48736782cac8aaa149232f050942c40092e50c4bfae73e2a29ddc169526

Observation b2ac2982-bf43-48a5-bc46-a9656d66f181 · outbound

This paper cites Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.206481Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.206481Z digest=sha256:b7b26edb9b0024ad289266ee57ff88575886617b3a83c29c6f0644b32ea6ac15

Observation 70090b81-bcbc-4764-890a-f84d4aae0c8f · outbound

This paper cites Navigating the grey area: Expressions of overconfidence and uncertainty in language models, 2023.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Navigating the grey area: Expressions of overconfidence and uncertainty in language models, 2023

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.119168Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.209775Z digest=sha256:8ca08173cf21fbde7f7539ef8638a22ec3b9d0e16d576d241e3a99c1a326238d

Observation 425ab6e1-d2b3-437c-a0e1-2b9c2380ce30 · outbound

This paper cites Fine-Tuning Language Models from Human Preferences.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Fine-Tuning Language Models from Human Preferences

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.212836Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.212836Z digest=sha256:296a4c3938a2db48f54e014f081995f5ff27de1cc103f3e7bca585e71837b6f5

Observation 360b2d10-5592-47bc-8985-5d0c1396371b · outbound

This paper cites write newline.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences write newline

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.216310Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.216310Z digest=sha256:c4c007ae0dbf1be1776c152dc0a44b822207b6dc31a8f982bf5e35824627e968

Pith citing papers

Observation bb3ea3df-bf2f-4af3-b0de-ea09f7ab73b9 · inbound

Inertia in Moral and Value Judgments of Large Language Models cites this paper.

Inertia in Moral and Value Judgments of Large Language Models Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

Reference 45

Resolution
verified exact
arxiv_id, observed 2026-05-23T22:05:50.180363Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-23T22:05:17.165589Z digest=sha256:b567d51147384cf6e6de458d8dc4f536da23d66f32dccf1b0285bdf5f81df6bd

Observation 43d71121-9bf3-4a26-abc6-13a748106daf · inbound

Reasoning Strategies in Large Language Models: Can They Follow, Prefer, and Optimize? cites this paper.

Reasoning Strategies in Large Language Models: Can They Follow, Prefer, and Optimize? Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T17:12:11.740039Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:12:11.740039Z digest=sha256:a5249e0c385d1fc60e6be03b611010a05d37d6541f5c7b9c8a5e2e5113400a8a

Observation 28674834-87fb-4268-b088-ed8ee9b67625 · inbound

Generalization of Fine-Tuned Uncertainty Communication and Metacognition in Large Language Models cites this paper.

Generalization of Fine-Tuned Uncertainty Communication and Metacognition in Large Language Models Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

Reference 701

Resolution
unresolved
no resolver link, observed 2026-08-04T13:32:26.582182Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T13:32:26.582182Z digest=sha256:92f191657576695a3d817ff160bfa61bae615e7a50cf86e92de74e299e5b20ed

Observation 1fd14fac-9697-41a6-aa7a-98d5603db9b9 · inbound

CLSGen: A Dual-Head Fine-Tuning Framework for Joint Probabilistic Classification and Verbalized Explanation cites this paper.

CLSGen: A Dual-Head Fine-Tuning Framework for Joint Probabilistic Classification and Verbalized Explanation Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-11T09:36:01.641462Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-10T15:57:23.435736Z digest=sha256:2caa3f50e95ff52b3ee4785d6a6a5b4441d0dee3da597934ab0aae5844913590

Observation e72eaddd-d3d4-4942-a0af-23b64811a8ff · inbound

Quantifying Consistency in LLM Logical Reasoning via Structural Uncertainty cites this paper.

Quantifying Consistency in LLM Logical Reasoning via Structural Uncertainty Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-07-03T18:08:46.662298Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-06-27T03:18:22.813002Z digest=sha256:344273d2589e6b57acdd335163bd7bd2cdbbf5d0423f3c02384242a8228b75e2

Observation 7bf6f57f-3570-48dd-bb75-b70e9ef523d9 · inbound

MARS-RA: Rank Aggregation for Credit Assignment via Multimodal Comparisons in Embodied Multi-Agent Cooperation cites this paper.

MARS-RA: Rank Aggregation for Credit Assignment via Multimodal Comparisons in Embodied Multi-Agent Cooperation Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

Reference 124

Resolution
unresolved
no resolver link, observed 2026-07-31T21:55:17.528034Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T21:55:17.528034Z digest=sha256:93826fcee31c52d926d8240190d78689fb1c7f25cfb25951fe3e6cddc723ce0f