Pith. sign in

Paper Citation Record · LEDGER

JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models

As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2501.14851.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2501.14851 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 11 of 11 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00

measured 11 of 11 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T12:44:31.930407Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-02T08:36:48.288216Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 72b29544-c055-4143-ac7c-1ea19c030df1 · inbound

Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models cites this paper.

Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models

Reference 90

Resolution
verified exact
arxiv_id, observed 2026-05-12T08:40:41.838340Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-12T08:40:40.910461Z digest=sha256:2447085dd6a0f90676bc99c96e31c0ab2ecc43d536f4b1c987e519b2278c68ec

Observation 9d8e7afd-0c1b-42ec-ad31-7d2a76d554fc · inbound

Improving Large Language Models with Concept-Aware Fine-Tuning cites this paper.

Improving Large Language Models with Concept-Aware Fine-Tuning JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T05:28:23.828084Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T05:28:23.828084Z digest=sha256:f1ed86080cdb3b55a44998f80ac44ecc6ad7c0d4b398c9cd2d089da19c1d1fa6

Observation f1e03c3c-9570-4a0d-85d8-caa872750e2a · inbound

PuzzleClone: A DSL-Powered Framework for Synthesizing Verifiable Data cites this paper.

PuzzleClone: A DSL-Powered Framework for Synthesizing Verifiable Data JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-05T18:08:39.208031Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T18:08:39.208031Z digest=sha256:af95e02c619a89d79eb7495fa93fe6c5b280c89a4df6ffa74115ff83ae11b6a5

Observation c3056f3b-8e04-49fa-acf3-cd2deee7a1bb · inbound

Logical Reasoning with Outcome Reward Models for Test-Time Scaling cites this paper.

Logical Reasoning with Outcome Reward Models for Test-Time Scaling JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-05T15:26:52.732798Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T15:26:52.732798Z digest=sha256:5036edba3cf1bd38ce69a0e97e6300bf1d311e7658741eada6fa24834bf83cb4

Observation 69fdc157-bbdc-465c-b495-18e1571d5675 · inbound

Rethinking Reasoning Quality in Large Language Models through Enhanced Chain-of-Thought via RL cites this paper.

Rethinking Reasoning Quality in Large Language Models through Enhanced Chain-of-Thought via RL JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-05T04:42:05.339231Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T04:42:05.339231Z digest=sha256:e732470cfbddb3cd05ca0ba1ee73d1d59ddfe040415665f9839a69f9a4f1c0b8

Observation 6cc57450-3bb8-4c04-b73b-577b89f2e726 · inbound

Deductive Logic in Language Models: Horizontal vs Vertical Reasoning cites this paper.

Deductive Logic in Language Models: Horizontal vs Vertical Reasoning JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-04T10:40:26.129286Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T10:40:26.129286Z digest=sha256:197dd5ef8f8984edc481031a1f3bb9c16099d4c66dc7c86a8638d03366eb1189

Observation 7362ad27-72dd-4ec8-85fb-8925dfdd4e3e · inbound

ReportLogic: Evaluating Logical Quality in Deep Research Reports cites this paper.

ReportLogic: Evaluating Logical Quality in Deep Research Reports JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models

Reference 2025

Resolution
unresolved
no resolver link, observed 2026-08-03T07:39:36.528740Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T07:39:36.528740Z digest=sha256:7d744a2d966c3f56adc0ff7b6c51c90ad56d6c3f53aba61fff4d6a25a32ff327

Observation 84285226-067d-4eb5-a01d-f02e4098194e · inbound

DeonticBench: A Benchmark for Reasoning over Rules cites this paper.

DeonticBench: A Benchmark for Reasoning over Rules JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models

Reference 6

Resolution
verified exact
arxiv_id, observed 2026-05-10T22:00:48.119873Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-10T20:22:03.956227Z digest=sha256:fe77c1c759ea8b6671068c554d6858f0ec7ab26a05fd9bada826d23e76c49f4d

Observation 87594534-a9fd-4b10-aec1-ec25d04af57c · inbound

DAR: Deontic Reasoning with Agentic Harnesses cites this paper.

DAR: Deontic Reasoning with Agentic Harnesses JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models

Reference 34

Resolution
metadata mismatch
arxiv_id, observed 2026-07-02T08:36:48.289884Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=arxiv_source observed=2026-06-28T05:55:19.924704Z digest=sha256:08d9b2174ee83335764e011e1856d146b63f63c25767522a2910b8af42a8bf11

Observation 50bfcbe8-7b85-4fea-a663-fddc2a596235 · inbound

Abductive Corroboration of Probabilistic AI Models for Forensic Synthetic Media Detection cites this paper.

Abductive Corroboration of Probabilistic AI Models for Forensic Synthetic Media Detection JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models

Reference 6

Resolution
unresolved
no resolver link, observed 2026-07-12T03:54:48.803944Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T03:54:48.803944Z digest=sha256:154a4f563a15ec9b1eaf556dcff663391fa2e2629a385cae871df7e847bec4f4

Observation 1d6aa5bc-2a07-47f9-8374-28c6e9e277b0 · inbound

What Current AI Benchmarks Leave Unmeasured: Modality, Search, Citations, and Implications (for Safety Evaluations) cites this paper.

What Current AI Benchmarks Leave Unmeasured: Modality, Search, Citations, and Implications (for Safety Evaluations) JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T12:44:31.930407Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T12:44:31.930407Z digest=sha256:a08f000247d785325ddf20df9707cb909e2e094edfac0e292021930058d90c26