Pith. sign in

Paper Citation Record · LEDGER

PRD: Peer Rank and Discussion Improve Large Language Model based Evaluations

As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2307.02762.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2307.02762 v3

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 10 of 10 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00

measured 10 of 10 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T10:17:46.909123Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-23T23:38:37.213575Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 8356853e-57b3-4401-b9b7-80195bc27957 · inbound

Replacing Judges with Juries: Evaluating LLM Generations with a Panel of Diverse Models cites this paper.

Replacing Judges with Juries: Evaluating LLM Generations with a Panel of Diverse Models PRD: Peer Rank and Discussion Improve Large Language Model based Evaluations

Reference 58

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T23:32:18.020934Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-05-15T23:32:17.279836Z digest=sha256:c29ed91a4efe712554e4c3af613d19034d5bd4778d6c6ee42cb2c0db5cb879c8

Observation d9894561-113d-4249-8f49-2e4a78c19147 · inbound

The Prompt Report: A Systematic Survey of Prompt Engineering Techniques cites this paper.

The Prompt Report: A Systematic Survey of Prompt Engineering Techniques PRD: Peer Rank and Discussion Improve Large Language Model based Evaluations

Reference 12

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T02:16:17.956202Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T02:16:17.875268Z digest=sha256:8b7a863465afc4818cccc63fd9b50e493b9952f7716af3612f88eabf36f035f2

Observation 7afb61fc-a695-4585-bb43-b88b9e3dd555 · inbound

AgentReview: Exploring Peer Review Dynamics with LLM Agents cites this paper.

AgentReview: Exploring Peer Review Dynamics with LLM Agents PRD: Peer Rank and Discussion Improve Large Language Model based Evaluations

Reference 16

Resolution
verified exact
arxiv_id, observed 2026-05-23T23:38:37.217566Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-23T23:38:28.005028Z digest=sha256:6e07a59efad25dd6fa51ec8042c7868e909f2753825e98ef18c6ae0b04d9a55b

Observation 07b64611-0d18-4aea-a4ea-fe50748114cc · inbound

LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods cites this paper.

LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods PRD: Peer Rank and Discussion Improve Large Language Model based Evaluations

Reference 137

Resolution
verified exact
arxiv_id, observed 2026-05-11T23:08:37.177887Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-11T23:08:34.312466Z digest=sha256:b105369e18f70f2767837dd5d101f60a5c7346b970559dc35cbf5ff712b2c757

Observation b84f9c7c-f98c-419e-b63d-718c381bf16b · inbound

A Survey of Automatic Evaluation Methods on Text, Visual and Speech Generations cites this paper.

A Survey of Automatic Evaluation Methods on Text, Visual and Speech Generations PRD: Peer Rank and Discussion Improve Large Language Model based Evaluations

Reference 192

Resolution
unresolved
no resolver link, observed 2026-08-07T10:17:46.909123Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T10:17:46.909123Z digest=sha256:dcb29e9fb540a0422085a1b4d30619a2798a3537fcae3a6b0ea159d2b33bd614

Observation 7db4046e-e50e-45f8-82f3-bc13de926a5a · inbound

How to Train a Leader: Hierarchical Reasoning in Multi-Agent LLMs cites this paper.

How to Train a Leader: Hierarchical Reasoning in Multi-Agent LLMs PRD: Peer Rank and Discussion Improve Large Language Model based Evaluations

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T18:12:58.824124Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T18:12:58.824124Z digest=sha256:f5b4cd3dd3212201ffcd5fe34b662bbb37e62c8913d05d2facf83886e9a35b75

Observation d8facfe0-c78c-4076-8fc1-ca919cf5a694 · inbound

OutSafe-Bench: A Benchmark for Multimodal Offensive Content Detection in Large Language Models cites this paper.

OutSafe-Bench: A Benchmark for Multimodal Offensive Content Detection in Large Language Models PRD: Peer Rank and Discussion Improve Large Language Model based Evaluations

Reference 28

Resolution
verified exact
arxiv_id, observed 2026-05-17T22:30:23.220898Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-17T22:29:36.960961Z digest=sha256:a1036eacb35ef473c4344419f4d2d4c92b3ed2613e50ace62b8b608c39b7f6cf

Observation 6f4470e7-f9ca-4a75-b77a-ae60e340d52b · inbound

EvalLoop: A Methodology for Evaluation-Driven Iterative Improvement of Business AI Systems cites this paper.

EvalLoop: A Methodology for Evaluation-Driven Iterative Improvement of Business AI Systems PRD: Peer Rank and Discussion Improve Large Language Model based Evaluations

Reference 7

Resolution
unresolved
no resolver link, observed 2026-07-11T04:31:30.304599Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-11T04:31:30.304599Z digest=sha256:29d735472a16f9a2476e8e9256d303bbdd01e30077de57ecc6960eb93f64d175

Observation 499ca143-1e6c-4175-8aad-4450614879ed · inbound

Training with (Swap) Regret Loss in a Single-Layer Self-Attention Model: A Case Study on the Probability Simplex cites this paper.

Training with (Swap) Regret Loss in a Single-Layer Self-Attention Model: A Case Study on the Probability Simplex PRD: Peer Rank and Discussion Improve Large Language Model based Evaluations

Reference 88

Resolution
unresolved
no resolver link, observed 2026-07-31T23:51:56.664011Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T23:51:56.664011Z digest=sha256:8b3074a6cba0ecebf4908bde6f4efa456983cb5ec9d250059d16afd8381cd608

Observation 0b1de192-1a69-4679-a3fe-3cc9fbe7bb51 · inbound

Chain-of-Models: Cross-Model Auditing for Bias-Robust LLM Judges cites this paper.

Chain-of-Models: Cross-Model Auditing for Bias-Robust LLM Judges PRD: Peer Rank and Discussion Improve Large Language Model based Evaluations

Reference 110

Resolution
unresolved
no resolver link, observed 2026-08-03T00:55:28.556575Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-03T00:55:28.556575Z digest=sha256:03606d7fa67cdde58f0025d32b633993d51ff49b5dd452a0cfe1b0e53eec8d21