Pith. sign in

Paper Citation Record · LEDGER

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

As of 13 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 6 inbound Pith citation observations for arXiv:2502.01126.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.01126 v1

Coverage vector

measured 55 of 55 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-09T16:34:01.216310Z

measured 61 of 61 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-13T06:32:02.005865+00:00

measured 6 of 6 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-06T17:12:11.740039Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-03T18:08:46.660526Z

Reference resolution

55 of 55 outbound references displayed

  • verified exact2
  • verified fuzzy20
  • unresolved33
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 038a8a8a-2c88-40a9-a9ea-9749e2ffe95e · outbound

This paper cites Claude 3.5 Sonnet.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Claude 3.5 Sonnet

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.353051Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.040680Z digest=sha256:85835e5ed4fd56514df7128cb0e9012766328546103c604cf02659da4fec3933

Observation b62ee666-6b2d-4217-ae83-ad0abd695d9f · outbound

This paper cites an unresolved cited work.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Unresolved cited work

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.044614Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.044614Z digest=sha256:4ecc5efd20bc50abc22bf433cd3af86e71feae158c7a9479d1a4583fc748cea7

Observation e509e91f-eca9-494a-ab27-11b4242163d4 · outbound

This paper cites Constitutional AI: Harmlessness from AI Feedback.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Constitutional AI: Harmlessness from AI Feedback

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.048322Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.048322Z digest=sha256:a956d6c0bcca7c2ef6e9c23bbb92d82ee499812a4f98e9fbed9bd49dc9ce537a

Observation 8d4c0e2e-7db0-4283-abd4-d9c69e4036ff · outbound

This paper cites an unresolved cited work.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Unresolved cited work

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.052216Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.052216Z digest=sha256:e92159a0adcba6aa2191d7d538526c58eefc5c953c7b070df307aa13f4392fbb

Observation dd974ade-36e1-4551-b740-d9bc4a07e3e4 · outbound

This paper cites Deep reinforcement learning from human preferences.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Deep reinforcement learning from human preferences

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.055766Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.055766Z digest=sha256:0eb0e2df9ac6d780bc222e4fe74543a310ff1a8c753e727ca873d67e352fd2aa

Observation 08ee4562-d1ac-4077-96c6-ba8fcb222618 · outbound

This paper cites DeGroot and Stephen E.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences DeGroot and Stephen E

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.336942Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.059492Z digest=sha256:c0434613a7d8e4acec22ddd122053ebba86f095c5f3c444711def583fcca7232

Observation c20c354f-7fac-4b5d-bcd9-8fce50d63381 · outbound

This paper cites The Llama 3 Herd of Models.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences The Llama 3 Herd of Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.062909Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.062909Z digest=sha256:675b9c4b184781bae2b7966b587a25bf0b3a340bb82f219bb785484ad811f2f6

Observation 5bab9d77-0b27-4b7b-b112-dc3b5792b670 · outbound

This paper cites Sivakumar.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Sivakumar

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.327066Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.066290Z digest=sha256:55b836d597de912180f34e7f2f18b24b0cc4e1cd9b432084e4c482390326d7e6

Observation 25bb767f-3e02-4c55-a6fd-94ae2ecbea01 · outbound

This paper cites On the foundations of noise-free selective classification.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences On the foundations of noise-free selective classification

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.317442Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.069315Z digest=sha256:7d967493d9c55569e5d5031f9f4b57eabd982d1ef2fe422779d10e9e5b26c067

Observation 96c38c8d-dad7-473d-8026-6f82bf3b170c · outbound

This paper cites The Rating of Chessplayers, Past and Present.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences The Rating of Chessplayers, Past and Present

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.072264Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.072264Z digest=sha256:8916a5b273f9f55289bb213d359b174a4df27ddfd9ebc2d33d84d87d66248e94

Observation 9ae8e036-984d-401d-bdb6-f64009ff1e13 · outbound

This paper cites KTO: Model Alignment as Prospect Theoretic Optimization.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences KTO: Model Alignment as Prospect Theoretic Optimization

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.078869Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.078869Z digest=sha256:7ad915a6f1524c8b03ee5d1cdd335653083451542130dc00492f697b8867cc87

Observation 9aa76400-b106-48be-b37c-9b7786440684 · outbound

This paper cites Selective prediction-set models with coverage guarantees.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Selective prediction-set models with coverage guarantees

Reference 12

Resolution
verified exact
local_arxiv, observed 2026-08-09T16:34:01.759266Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.082725Z digest=sha256:749c12d1ec5fa4e7d7d1a6056e65a6ca1b4043046a9dadc8efbefbae062ef04e

Observation 84c0728d-b3a4-4b59-9740-b39a87669bfe · outbound

This paper cites Gptscore: Evaluate as you desire.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Gptscore: Evaluate as you desire

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.307483Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.086497Z digest=sha256:3abf1d9f88a8d515b5b7293ba6a15bd0b324e80027eae19ec3e83df7902b095e

Observation 3feebc79-0d96-458c-95dd-9bf0520e9029 · outbound

This paper cites On Calibration of Modern Neural Networks.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences On Calibration of Modern Neural Networks

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.089663Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.089663Z digest=sha256:3f025c51a66bd7f11604d720468f72364da1e6b007de70c88278bb8ae721f218

Observation eec04e32-23a9-4e57-bff1-806039ae5465 · outbound

This paper cites Weinberger.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Weinberger

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.297820Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.093138Z digest=sha256:e7199330bffea450b5cbf34c9aa1bfb7498328d5036865cba782a25b962c0415

Observation 1b1f8248-2013-4fe3-b151-4b20f7fdf2c7 · outbound

This paper cites A baseline for detecting misclassified and out-of-distribution examples in neural networks.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences A baseline for detecting misclassified and out-of-distribution examples in neural networks

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.096221Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.096221Z digest=sha256:ad7135585f45d8a4e9d8c3ab69a6c6dec9a8257df20df1229d9522b9e9edc399

Observation 24e92e21-8248-4067-b93c-ffb1897ae9a2 · outbound

This paper cites Measuring massive multitask language understanding.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Measuring massive multitask language understanding

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.282327Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.099247Z digest=sha256:0c0b00fbbdb91679eaddd47a95d86f76ee7bc891dce6ccbf8721086ff4e10936

Observation 8f8a93b4-2247-4cdd-9bfd-ceab9fcf0f74 · outbound

This paper cites Measuring Mathematical Problem Solving With the MATH Dataset.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Measuring Mathematical Problem Solving With the MATH Dataset

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.102298Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.102298Z digest=sha256:b0679adba39c2bc8852f86937da35c911ab6d13738b504c3ef6fdd3e07edb6bb

Observation 7598ce1d-e0dd-466c-8826-c37ce81c98b7 · outbound

This paper cites Minka, and Thore Graepel.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Minka, and Thore Graepel

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.272584Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.105681Z digest=sha256:99e266bbf8d8508e5ceb73bdc93518b15d75dae07b05e5c56dd63acf812a614e

Observation ff0b0cc7-f982-4dc0-999b-8b60016070d5 · outbound

This paper cites What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.108285Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.108285Z digest=sha256:8cb687cf59f3434355597a5371e1552e567c2ae4c8bf598b471e028c75f6042f

Observation 8b5e1787-7bf2-43de-94cf-8f1335f3d6f1 · outbound

This paper cites Selective classification can magnify disparities across groups.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Selective classification can magnify disparities across groups

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.262978Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.111175Z digest=sha256:a3cc667190b78c401b36c0a0aca39242227658cdef136c07eb291f449c42f2ac

Observation 6c3ee263-67cd-451d-8919-8526caca3851 · outbound

This paper cites Language models (mostly) know what they know, 2022.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Language models (mostly) know what they know, 2022

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.114327Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.114327Z digest=sha256:be3459e9e7c9a2af6ae44e9ee39645222e608131d6c5bc7fc2cd7401ef953749

Observation 214b97c4-088e-4703-9659-0bf53bcb0b76 · outbound

This paper cites Kemeny and J.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Kemeny and J

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.117257Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.117257Z digest=sha256:14ea7b2f755fb3dbf1261f4ed58bd79f2e4cb9d19da16dfe781855732abfbf14

Observation 835eca9d-2993-4d03-97c4-b2cf7246dd56 · outbound

This paper cites Unanimous prediction for 100\ In Association for Computational Linguistics (ACL), 2016.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Unanimous prediction for 100\ In Association for Computational Linguistics (ACL), 2016

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.247076Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.119947Z digest=sha256:67c74de8515993be0a956c7b176e62e3a348b6c0e7e4ab8b147efce7c6d660f0

Observation 06999197-03dc-4598-b2eb-405ce3fdcf68 · outbound

This paper cites Holistic Evaluation of Language Models.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Holistic Evaluation of Language Models

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.122641Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.122641Z digest=sha256:d9ccef81cb1ec496b32b4a9fdb8baa17ac28b2813890753d60a394d64a4de20a

Observation 8d5cf93c-90ee-401f-8f68-ed55cd51c49c · outbound

This paper cites TruthfulQA: Measuring How Models Mimic Human Falsehoods.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences TruthfulQA: Measuring How Models Mimic Human Falsehoods

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.125363Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.125363Z digest=sha256:e8cf05b58c3e58ec387ac7aa56a01d1fd1b028ffa517d39b1de3c2cf48d37f84

Observation 03507724-f635-4e18-9ef5-b3ed1d0d7dcf · outbound

This paper cites Teaching models to express their uncertainty in words.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Teaching models to express their uncertainty in words

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.128934Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.128934Z digest=sha256:75d44eb22c0caf66be33f3a5a8c4001f6e1f353593ae93bfa26665be92a1df9b

Observation c6e9c625-e1fd-46bd-b41a-cfe9d4556419 · outbound

This paper cites Self-Refine: Iterative Refinement with Self-Feedback.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Self-Refine: Iterative Refinement with Self-Feedback

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.131879Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.131879Z digest=sha256:fd92cd8dd13e640698ec1634392588ded0ed0fba30f6e658a91c4efc09940f02

Observation fc686808-1158-4955-a2a4-f7374a987631 · outbound

This paper cites Can a suit of armor conduct electricity? a new dataset for open book question answering.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Can a suit of armor conduct electricity? a new dataset for open book question answering

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.230402Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.135067Z digest=sha256:8775d2e28aeee5aba4909a99d68716c22ad5b5d516ed2160075cf76b927bfe50

Observation 61d12a34-b748-494d-b47d-10e35f762cbe · outbound

This paper cites Murphy and Robert L.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Murphy and Robert L

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.220422Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.138224Z digest=sha256:20c557e2a7e29fcb9fb738817b804709a0215fbdc0a0df1214487034b4a5a4bc

Observation 4bf1fa61-233e-4c5e-9403-b6c7626adde1 · outbound

This paper cites Cooper, and Milos Hauskrecht.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Cooper, and Milos Hauskrecht

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.210087Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.141299Z digest=sha256:8083fe1d80fdd5e26274ed41a4e6916f4451f597f7e0526a5e8398cbb62f58c5

Observation 809fcde4-914b-4aae-a4e7-5740952b6dc1 · outbound

This paper cites Cooper, and Milos Hauskrecht.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Cooper, and Milos Hauskrecht

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.200526Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.144307Z digest=sha256:54111f1c110ddb732ef5878cc570489b43a2e3c9b906e2615cde3b346726411b

Observation fb0ad1e6-d1d5-4f90-a3a8-d037c20bf836 · outbound

This paper cites Negahban, Sewoong Oh, and Devavrat Shah.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Negahban, Sewoong Oh, and Devavrat Shah

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.190942Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.147483Z digest=sha256:8ed3442aa1e5dfdf7f72001ed17b8314c0c246b2defc8325d798d8cbad5999d9

Observation c8371c9a-25c4-4a57-9b5f-6d07069b7ca9 · outbound

This paper cites Introducing chatgpt.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Introducing chatgpt

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.180830Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.150539Z digest=sha256:f6b2badb2a953b8e6543764ebfd00c0c4659dc18c7a28a841ebb878b13d302e9

Observation 1eba87ca-a0ff-4536-913c-2e85d49ef04f · outbound

This paper cites an unresolved cited work.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Unresolved cited work

Reference 35

Resolution
unresolved
raw_fallback, observed 2026-08-09T16:34:02.170988Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.153861Z digest=sha256:91aedd1ac738cc935fd7fd9647d9c0e82d7827902f2acaaf5ecd441a04044686

Observation b6fe4d77-bb6e-438c-9d33-5bfba0793266 · outbound

This paper cites an unresolved cited work.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Unresolved cited work

Reference 36

Resolution
unresolved
raw_fallback, observed 2026-08-09T16:34:02.160560Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.156787Z digest=sha256:c484ce7b26f6d638dae578d9bc76f8abd3593073cd1883fc73d8df2ad1eebc3f

Observation c2980b56-f760-43b1-8d41-0216320d50f9 · outbound

This paper cites Training language models to follow instructions with human feedback.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Training language models to follow instructions with human feedback

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.159841Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.159841Z digest=sha256:1980132781d6d618a340419ffd73c0a4b3f634571936000b8ce072c2bdf1b351

Observation 14675387-9817-4f41-8561-634655389597 · outbound

This paper cites The pagerank citation ranking : Bringing order to the web.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences The pagerank citation ranking : Bringing order to the web

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.150163Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.163222Z digest=sha256:1faf0197800f8a6541fbf0cac7a0fdd087499e2dfa7d43af3220ce101794ade0

Observation ccdef85f-4f49-4f33-99bc-d43929110c23 · outbound

This paper cites Direct Preference Optimization: Your Language Model is Secretly a Reward Model.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Direct Preference Optimization: Your Language Model is Secretly a Reward Model

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.166117Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.166117Z digest=sha256:e8fb8db7801d95bc6a0fcc2182fbb552767999a62dfbac5c7305ea8351d5b719

Observation 6cc7a1ab-0bfa-456e-84d3-9794834aace5 · outbound

This paper cites GPQA: A Graduate-Level Google-Proof Q&A Benchmark.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences GPQA: A Graduate-Level Google-Proof Q&A Benchmark

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.169386Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.169386Z digest=sha256:84d7a11b042fc16aa9d780d7b3d83a58d218c0db21e4991e282193f458b33604

Observation 61db9865-fe90-4a1d-92a6-3fc53e1f211a · outbound

This paper cites SocialIQA: Commonsense Reasoning about Social Interactions.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences SocialIQA: Commonsense Reasoning about Social Interactions

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.172731Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.172731Z digest=sha256:d623a437e2094eaad2082c87f37e1bd84b948647a62cd08a352877e365ec9c8b

Observation 1b190f9c-eaa6-47a0-9b53-f2eb4ebbd08e · outbound

This paper cites Llamas Know What GPTs Don't Show: Surrogate Models for Confidence Estimation.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Llamas Know What GPTs Don't Show: Surrogate Models for Confidence Estimation

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.176258Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.176258Z digest=sha256:042f2e007932b04088e7f611bc92f9db1a554bca1ce370e3205537fa6a4cb72a

Observation 5f533e8a-e0eb-49b3-b257-28eb7152f05d · outbound

This paper cites Commonsenseqa: A question answering challenge targeting commonsense knowledge.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Commonsenseqa: A question answering challenge targeting commonsense knowledge

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.140002Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.179834Z digest=sha256:33f4cb5df834343f0ae85e249d26640da06fd1725552073663813b0abb6f0344

Observation 2124298d-b595-4338-a9f5-e0e5259c4e55 · outbound

This paper cites Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.182852Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.182852Z digest=sha256:aa09adeb8446e0d7a4570bc43d3f34c21eb08cfe4500dee1c6cc230c5e9660ef

Observation 65bf4de6-e9e0-4442-8bd8-c5423652d08f · outbound

This paper cites Fine-tuning Language Models for Factuality.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Fine-tuning Language Models for Factuality

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.186499Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.186499Z digest=sha256:22b06a8a61634326f0e904ce1814fe4729968b5e351c2341c11fa6644d496574

Observation c6f56a58-80d5-4552-824c-d62dbe82c527 · outbound

This paper cites Nicolaus Tideman.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Nicolaus Tideman

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.129491Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.189808Z digest=sha256:389904d85a45c65ab2a7667a8572b537b57e87061c134f4aa61b1622d4040f9e

Observation 395bdfd9-87ea-469d-be88-b663e9bbf964 · outbound

This paper cites Minimum weighted feedback arc sets for ranking from pairwise comparisons.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Minimum weighted feedback arc sets for ranking from pairwise comparisons

Reference 47

Resolution
verified exact
arxiv_id, observed 2026-08-09T16:34:01.493854Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.192801Z digest=sha256:9e40489c7c8678b7ba29592b88812f4442d9dbbc1107d0c8e0c9438f7acaf94f

Observation 675fb41e-9d80-45c8-8a65-7ea8e7942630 · outbound

This paper cites Self-Consistency Improves Chain of Thought Reasoning in Language Models.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Self-Consistency Improves Chain of Thought Reasoning in Language Models

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.195288Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.195288Z digest=sha256:aae58fe0ba77365ccd1945addb0e667239f708063525b429b13ddda90d40ec7b

Observation fa845f90-2b3f-44b0-979b-8234e270609e · outbound

This paper cites Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.198146Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.198146Z digest=sha256:b1325ea91bef13469cf7bf36407b831c1fa365abf9163caaa4290eb110a6ecf9

Observation 9b626cbf-2f47-49aa-982f-bf923d01ef5c · outbound

This paper cites Tree of Thoughts: Deliberate Problem Solving with Large Language Models.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Tree of Thoughts: Deliberate Problem Solving with Large Language Models

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.200844Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.200844Z digest=sha256:c99ca75735c748ec14eeab2ca8709a121523d021b777f3fdec72d9735a67436d

Observation 56b68cfa-eb5d-43fe-8c34-ae891a55b512 · outbound

This paper cites Self-Rewarding Language Models.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Self-Rewarding Language Models

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.203730Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.203730Z digest=sha256:12dba48736782cac8aaa149232f050942c40092e50c4bfae73e2a29ddc169526

Observation b2ac2982-bf43-48a5-bc46-a9656d66f181 · outbound

This paper cites Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.206481Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.206481Z digest=sha256:b7b26edb9b0024ad289266ee57ff88575886617b3a83c29c6f0644b32ea6ac15

Observation 70090b81-bcbc-4764-890a-f84d4aae0c8f · outbound

This paper cites Navigating the grey area: Expressions of overconfidence and uncertainty in language models, 2023.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Navigating the grey area: Expressions of overconfidence and uncertainty in language models, 2023

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T16:34:02.119168Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-08-09T16:34:01.209775Z digest=sha256:0ef4d2110c09a545736bf1596eca220ae17360c61b696eb8e05b4d32ccf36c68

Observation 425ab6e1-d2b3-437c-a0e1-2b9c2380ce30 · outbound

This paper cites Fine-Tuning Language Models from Human Preferences.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences Fine-Tuning Language Models from Human Preferences

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.212836Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.212836Z digest=sha256:296a4c3938a2db48f54e014f081995f5ff27de1cc103f3e7bca585e71837b6f5

Observation 360b2d10-5592-47bc-8985-5d0c1396371b · outbound

This paper cites write newline.

Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences write newline

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-09T16:34:01.216310Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-09T16:34:01.216310Z digest=sha256:c4c007ae0dbf1be1776c152dc0a44b822207b6dc31a8f982bf5e35824627e968

Pith citing papers

Observation bb3ea3df-bf2f-4af3-b0de-ea09f7ab73b9 · inbound

Inertia in Moral and Value Judgments of Large Language Models cites this paper.

Inertia in Moral and Value Judgments of Large Language Models Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

Reference 45

Resolution
verified exact
arxiv_id, observed 2026-05-23T22:05:50.180363Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=arxiv_source observed=2026-05-23T22:05:17.165589Z digest=sha256:fc8d78f1b9df5730fc2f67688874bbe23068c84b5a67db7e1ed6f18fb93a99af

Observation 43d71121-9bf3-4a26-abc6-13a748106daf · inbound

Reasoning Strategies in Large Language Models: Can They Follow, Prefer, and Optimize? cites this paper.

Reasoning Strategies in Large Language Models: Can They Follow, Prefer, and Optimize? Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T17:12:11.740039Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T17:12:11.740039Z digest=sha256:a5249e0c385d1fc60e6be03b611010a05d37d6541f5c7b9c8a5e2e5113400a8a

Observation 28674834-87fb-4268-b088-ed8ee9b67625 · inbound

Generalization of Fine-Tuned Uncertainty Communication and Metacognition in Large Language Models cites this paper.

Generalization of Fine-Tuned Uncertainty Communication and Metacognition in Large Language Models Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

Reference 701

Resolution
unresolved
no resolver link, observed 2026-08-04T13:32:26.582182Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T13:32:26.582182Z digest=sha256:92f191657576695a3d817ff160bfa61bae615e7a50cf86e92de74e299e5b20ed

Observation 1fd14fac-9697-41a6-aa7a-98d5603db9b9 · inbound

CLSGen: A Dual-Head Fine-Tuning Framework for Joint Probabilistic Classification and Verbalized Explanation cites this paper.

CLSGen: A Dual-Head Fine-Tuning Framework for Joint Probabilistic Classification and Verbalized Explanation Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-11T09:36:01.641462Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-05-10T15:57:23.435736Z digest=sha256:30419156a3d8344d8bf4144e79685b71443152959738b1334a08f47f03ebbeac

Observation e72eaddd-d3d4-4942-a0af-23b64811a8ff · inbound

Quantifying Consistency in LLM Logical Reasoning via Structural Uncertainty cites this paper.

Quantifying Consistency in LLM Logical Reasoning via Structural Uncertainty Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-07-03T18:08:46.662298Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.

source=pdf_text observed=2026-06-27T03:18:22.813002Z digest=sha256:957897ae12da03c746e64b70f264c2c7b4b30791482d8e0d9ed3f4a938de6604

Observation 7bf6f57f-3570-48dd-bb75-b70e9ef523d9 · inbound

MARS-RA: Rank Aggregation for Credit Assignment via Multimodal Comparisons in Embodied Multi-Agent Cooperation cites this paper.

MARS-RA: Rank Aggregation for Credit Assignment via Multimodal Comparisons in Embodied Multi-Agent Cooperation Language Models Prefer What They Know: Relative Confidence Estimation via Confidence Preferences

Reference 124

Resolution
unresolved
no resolver link, observed 2026-07-31T21:55:17.528034Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T21:55:17.528034Z digest=sha256:93826fcee31c52d926d8240190d78689fb1c7f25cfb25951fe3e6cddc723ce0f