Pith. sign in

Paper Citation Record · LEDGER

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment

As of 6 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 1 inbound Pith citation observation for arXiv:2604.11543.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2604.11543 v1

Coverage vector

measured 20 of 20 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-05-10T16:20:44.551760Z

measured 21 of 21 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-05T06:32:48.257954+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-11T19:11:37.739920Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

20 of 20 outbound references displayed

  • verified exact4
  • verified fuzzy4
  • unresolved11
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation eafd7f3e-a649-47d6-a7bb-8b9ae0975af5 · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 1

Resolution
verified exact
local_arxiv, observed 2026-05-11T09:00:59.495696Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:e185378e32422aad344b6fa22f83d061e50129cc494b578a0e5c07dc7d034fc4

Observation 549321d4-00f7-49dd-8656-19a035c7dd3d · outbound

This paper cites Reviewer2: Optimizing Review Generation Through Prompt Generation.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Reviewer2: Optimizing Review Generation Through Prompt Generation

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-05-11T09:00:59.510291Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:fda37a0014d80e40d900fc6be66e7af19899b09746b57c4109286373ea20a617

Observation b167f2c2-79f3-4de0-998d-0323b8fbeb2e · outbound

This paper cites Qwen3 Technical Report.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Qwen3 Technical Report

Reference 3

Resolution
metadata mismatch
local_arxiv, observed 2026-05-11T09:00:59.506448Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:aa7a5c22c617f56e1cc7a71681db981c3af65a5db5c472ca53e058f68089d3cc

Observation 63383334-3769-4905-a759-e0ccc87bb527 · outbound

This paper cites In this paper, we propose a novel transformer-based architecture that integrates syntactic information into language modeling.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment In this paper, we propose a novel transformer-based architecture that integrates syntactic information into language modeling

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T15:51:55.690274Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:ca1c646f258dd0991cad72e6a217fa1978c56661788281e0f0c14cd73c43ebe4

Observation 0eb517ab-6a4a-46ce-8f8f-0580acba526a · outbound

This paper cites an unresolved cited work.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-05-17T15:51:55.698838Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:34c605249a598f56736d7f357d14012e3b30012f28745bf7c898a42a6cdead04

Observation 72de0aff-8759-4edd-aa05-23afe4915516 · outbound

This paper cites new” or “novel.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment new” or “novel

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T15:51:55.687412Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:947d6a1203c64758db251442dcdf10d65ca16d4f20d5164f1324636bdb16cec2

Observation 94dd6201-2778-4c0a-8a30-9a7329312a30 · outbound

This paper cites an unresolved cited work.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Unresolved cited work

Reference 7

Resolution
unresolved
raw_fallback, observed 2026-05-17T15:51:55.701173Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:6d0bab90705ce53ffc582bcc877b0ed012c219eb7a91b46e16e96cebbb2b6407

Observation c725fa04-ab54-463d-a369-97f581cb76c2 · outbound

This paper cites an unresolved cited work.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Unresolved cited work

Reference 8

Resolution
unresolved
raw_fallback, observed 2026-05-17T15:51:55.703886Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:8036fe7844a2a209fec88195a5343eba381883ba116dc64613de50b5154d33c9

Observation 56785e2a-4cf8-4a0d-a3f1-45a313b764a2 · outbound

This paper cites Model Rel.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Model Rel

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-11T09:00:59.517496Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:0ebbae8962535af537557c8897ebd31be76efffc2d87cfcd3cb0b5d769934d48

Observation f0a9b020-82c1-478f-bf94-b814151b25fc · outbound

This paper cites an unresolved cited work.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-05-17T15:51:55.691927Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:8ce3dfe4e41c8012e09676d8a11496e45f4816febeafa6cb5ac84efa68f38e96

Observation 994c9fba-8ee9-488f-98f0-8a0daf603174 · outbound

This paper cites an unresolved cited work.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-05-17T15:51:55.710497Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:6dfd46d97c33f9aa3ccf1b20005ffb0f164fb6feec0495afcee15d355b32e384

Observation ee18ed52-e0c6-4146-8f77-0da3becbcf71 · outbound

This paper cites an unresolved cited work.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-05-17T15:51:55.706728Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:2bd8d46ab0c22917ca3ad99a354f471618b9a57951fdf079f4b8f79d5702fe06

Observation e02ed532-d340-49e3-b8a2-c4f170d9db5d · outbound

This paper cites Positive.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Positive

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T15:51:55.701873Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:6e3cbdbf81deb365cb6c46c3d88ea73fce701c9029366e9d00f28ae351188efa

Observation 5bebbff7-f2a0-4837-b2bc-1bb4089855bc · outbound

This paper cites an unresolved cited work.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-05-17T15:51:55.677264Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:49a5ef89bae970e1877f7c62f7431876a7c17bcfa5127fe77eee848dfdf51575

Observation 3198bb5c-e29e-4549-97b8-a4ca65fb4bb7 · outbound

This paper cites Positive.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Positive

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-05-17T15:51:55.679943Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:3ad0ed4415f6a9d3c3f7cfa2ba18d147c5f20d5864afef58a7ac4c2171c131a0

Observation abca0b71-f0a7-4ed0-a5bd-923c80450c65 · outbound

This paper cites an unresolved cited work.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Unresolved cited work

Reference 16

Resolution
unresolved
raw_fallback, observed 2026-05-17T15:51:55.674403Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:95ee9f5e957cdee611d1a61fdbecf03095b73485c467d880265ecf45de110fcf

Observation 3e3f5e1a-e356-4cf4-8db7-6890c4dc7233 · outbound

This paper cites an unresolved cited work.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-05-17T15:51:55.671690Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:673ed2d8054cda3cd416fdd06dd1b2c8fe582101a1a560c90f7153f43b4b8d44

Observation 55b7180e-8425-41f7-9858-936e1378c8f3 · outbound

This paper cites an unresolved cited work.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-05-17T15:51:55.682544Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:576a6812227aff9b5740e519159eefe6f2169221c225164c4a8945d89b5a7127

Observation ef92de0c-610f-46fe-b46f-03f60cfbc9f7 · outbound

This paper cites an unresolved cited work.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-05-17T15:51:55.685126Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:7eebe96292404d2921d9e25d59751c5dfdf336af903cd12cd8a91c5c3758002b

Observation ec5b6199-75b3-4877-b1da-c98080b75e3d · outbound

This paper cites Discriminative Reasoning for Document-level Relation Extraction.

NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment Discriminative Reasoning for Document-level Relation Extraction

Reference 20

Resolution
verified exact
arxiv_id, observed 2026-05-11T09:00:59.514014Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.

source=pdf_text observed=2026-05-10T16:20:44.551760Z digest=sha256:05b385f92d027b12dcacf41735754e0b5217e4f54b76ca4e40e59d89cda3e108

Pith citing papers

Observation 2c66d0b1-a6ba-411f-9315-b777d9679cfd · inbound

ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes cites this paper.

ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes NovBench: Evaluating Large Language Models on Academic Paper Novelty Assessment

Reference 56

Resolution
unresolved
no resolver link, observed 2026-07-11T19:11:37.739920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-11T19:11:37.739920Z digest=sha256:70fd721c737f31757a0bfa7054581534e3e85d972db3cd072d8dce10b907fffa