Pith. sign in

Paper Citation Record · LEDGER

TheoremQA: A Theorem-driven Question Answering dataset

As of 16 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 26 inbound Pith citation observations for arXiv:2305.12524.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2305.12524 v3

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 26 of 26 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-16T06:30:59.297886+00:00

measured 26 of 26 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-16T11:18:43.694125Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

5
arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 3dcfd77e-f6fd-484c-820f-60e49dc0199c · inbound

Detecting Language Model Attacks with Perplexity cites this paper.

Detecting Language Model Attacks with Perplexity TheoremQA: A Theorem-driven Question Answering dataset

Reference 64

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T14:02:26.851987Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-05-15T14:02:26.784965Z digest=sha256:9b3bdd3aa03af6ce7dad382841f10bbb22af948a8081bd7229bdad66ea391d4b

Observation c56ec44e-dcdf-4312-9fd8-4f0e53bc1777 · inbound

MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning cites this paper.

MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning TheoremQA: A Theorem-driven Question Answering dataset

Reference 6

Resolution
verified exact
arxiv_id, observed 2026-05-17T23:46:39.578030Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-05-17T23:46:39.330438Z digest=sha256:4f116be2db3932e13df090e766dbfd870376f88876ee71cb7905d11792ea08c9

Observation 20156598-86f9-43a7-90ea-5ba7bc88a0b5 · inbound

Using Large Language Models for education managements in Vietnamese with low resources cites this paper.

Using Large Language Models for education managements in Vietnamese with low resources TheoremQA: A Theorem-driven Question Answering dataset

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-10T14:44:27.018806Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-10T14:44:27.018806Z digest=sha256:c0cff152df907fafbecd3088908634ad84244de350c873eca993abccb719a7ee

Observation a26b6887-0520-4c9d-b70a-13099a1d0724 · inbound

Fino1: On the Transferability of Reasoning-Enhanced LLMs and Reinforcement Learning to Finance cites this paper.

Fino1: On the Transferability of Reasoning-Enhanced LLMs and Reinforcement Learning to Finance TheoremQA: A Theorem-driven Question Answering dataset

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-08T10:25:12.933343Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-08T10:25:12.933343Z digest=sha256:accb2b90be8fcc503f5c5d09273642138936165864bbd4ce29e1e493692ed67f

Observation d46a7824-479f-4516-8534-8d27ca290fa7 · inbound

Synergizing RAG and Reasoning: A Systematic Review cites this paper.

Synergizing RAG and Reasoning: A Systematic Review TheoremQA: A Theorem-driven Question Answering dataset

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-16T11:18:43.694125Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:18:43.694125Z digest=sha256:81d10603e2b9cb91bb88a5d7c49712e10a8f644877adf0cb781eb514814be277

Observation 3dee0133-3b17-47d5-8d96-24a25883598f · inbound

Reinforced MLLM: A Survey on RL-Based Reasoning in Multimodal Large Language Models cites this paper.

Reinforced MLLM: A Survey on RL-Based Reasoning in Multimodal Large Language Models TheoremQA: A Theorem-driven Question Answering dataset

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-16T05:12:18.137395Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T05:12:18.137395Z digest=sha256:4199854a9b1c1bf50b2bd38181ce7ecacafdc82ef6ca7d38d322997a801882d4

Observation 5a431d61-daf8-4a7e-897a-e5c964430a73 · inbound

PhySense: Principle-Based Physics Reasoning Benchmarking for Large Language Models cites this paper.

PhySense: Principle-Based Physics Reasoning Benchmarking for Large Language Models TheoremQA: A Theorem-driven Question Answering dataset

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T12:22:24.562397Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:22:24.562397Z digest=sha256:db9138c485bd28b52a41968f67a73e80182ae751fcd7f66ff1c16a090885f8cb

Observation db6db4af-9926-4f46-9e83-3b382a3516cf · inbound

VRBench: A Benchmark for Multi-Step Reasoning in Long Narrative Videos cites this paper.

VRBench: A Benchmark for Multi-Step Reasoning in Long Narrative Videos TheoremQA: A Theorem-driven Question Answering dataset

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T04:22:55.808811Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:22:55.808811Z digest=sha256:d5b876aeb2a1017af25817882fd0544f413165ec9e0c84abf6b3584ce38ae70e

Observation c1605fa3-3497-438e-af25-46e2dd63d94d · inbound

RLPR: Extrapolating RLVR to General Domains without Verifiers cites this paper.

RLPR: Extrapolating RLVR to General Domains without Verifiers TheoremQA: A Theorem-driven Question Answering dataset

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-15T19:01:06.253262Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T19:01:06.253262Z digest=sha256:de9c42eefebf98d3cf97357651ef9436a2fa35b832753bf7b4a7ff959c9929d1

Observation 544c9ab7-187e-4720-86cb-1ddfdb39c3ef · inbound

AI4Research: A Survey of Artificial Intelligence for Scientific Research cites this paper.

AI4Research: A Survey of Artificial Intelligence for Scientific Research TheoremQA: A Theorem-driven Question Answering dataset

Reference 115

Resolution
unresolved
no resolver link, observed 2026-08-06T20:45:12.276433Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:45:12.276433Z digest=sha256:7e32b88ed750ae6cb1edb95813fbe5cabb164017d983160b06f040e1c3dafee8

Observation 73dc1681-ec6e-4b8f-9a9b-84e118096ee2 · inbound

A Simple "Try Again" Can Elicit Multi-Turn LLM Reasoning cites this paper.

A Simple "Try Again" Can Elicit Multi-Turn LLM Reasoning TheoremQA: A Theorem-driven Question Answering dataset

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T16:14:06.336764Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T16:14:06.336764Z digest=sha256:b83a528adbb607ee597eea62dedf9ed877fe2d47569dd2e851a75e78e980858c

Observation badd2157-376d-4368-8576-60a08c70ce9c · inbound

Technical Report of TeleChat2, TeleChat2.5 and T1 cites this paper.

Technical Report of TeleChat2, TeleChat2.5 and T1 TheoremQA: A Theorem-driven Question Answering dataset

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-06T14:43:22.133785Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T14:43:22.133785Z digest=sha256:c47080ef2f1a10c7a4e3e27aa0ba9fb4da7b951b8b3febcc92e29ca1499be6d5

Observation 07e29574-872c-411d-8ed4-ad2c22df3d9d · inbound

CLPO: Curriculum Learning meets Policy Optimization for LLM Reasoning cites this paper.

CLPO: Curriculum Learning meets Policy Optimization for LLM Reasoning TheoremQA: A Theorem-driven Question Answering dataset

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-04T13:53:32.793396Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T13:53:32.793396Z digest=sha256:3d5045d9a49a9bd686a56c6f2b685fe211e6c36c6c68d37b2b5ee424ff5b4736

Observation b780332e-3272-4f9f-9140-df45cd86e9c8 · inbound

StatEval: A Comprehensive Benchmark for Large Language Models in Statistics cites this paper.

StatEval: A Comprehensive Benchmark for Large Language Models in Statistics TheoremQA: A Theorem-driven Question Answering dataset

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-04T10:36:23.048036Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-04T10:36:23.048036Z digest=sha256:a2fca39dd39fca7bfab41f81464c02b71f40857ccf410cdda1bc84ae5bfae008

Observation c0545efa-1a4e-4f6a-8a2b-a39b66788a1a · inbound

Coupled Variational Reinforcement Learning for Language Model General Reasoning cites this paper.

Coupled Variational Reinforcement Learning for Language Model General Reasoning TheoremQA: A Theorem-driven Question Answering dataset

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-03T16:43:54.710371Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T16:43:54.710371Z digest=sha256:ea9ae559d1f29091db74107a40df1c512837a111562a87042e470accbaa21ba0

Observation 496e4370-6c12-4101-855b-9466cceec120 · inbound

Empirical Characterization of Inference-Time Elicited Probability Transformations in Large Language Models cites this paper.

Empirical Characterization of Inference-Time Elicited Probability Transformations in Large Language Models TheoremQA: A Theorem-driven Question Answering dataset

Reference 2016

Resolution
unresolved
no resolver link, observed 2026-08-02T20:21:54.834919Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T20:21:54.834919Z digest=sha256:52e0db652e3f16a4c7f4dd859c1e00d780e45e8f5e0fe18f2b7ae29dd656479a

Observation e4124a06-c1d1-4248-b5d1-0b04d08da3ca · inbound

FeynmanBench: Benchmarking Multimodal LLMs on Diagrammatic Physics Reasoning cites this paper.

FeynmanBench: Benchmarking Multimodal LLMs on Diagrammatic Physics Reasoning TheoremQA: A Theorem-driven Question Answering dataset

Reference 9

Resolution
verified exact
arxiv_id, observed 2026-05-13T16:52:59.463228Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-05-13T16:51:48.705876Z digest=sha256:94f0b5f029a6b94b3b950cb4fb489b0c4fc24d8a09046f120009411ffb029385

Observation 0ac21af9-42bb-4318-b6e2-3946858e5435 · inbound

FeynmanBench: Benchmarking Multimodal LLMs on Diagrammatic Physics Reasoning cites this paper.

FeynmanBench: Benchmarking Multimodal LLMs on Diagrammatic Physics Reasoning TheoremQA: A Theorem-driven Question Answering dataset

Reference 9

Resolution
unresolved
no resolver link, observed 2026-07-13T12:10:53.720348Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T12:10:53.720348Z digest=sha256:2b484bb179d060cd48b4ad9bdb08fa6d207246b5a35b6419b61eeb9a2a18e7d8

Observation e4e1e23c-db95-414c-a114-ae0def66b3db · inbound

Transforming External Knowledge into Triplets for Enhanced Retrieval in RAG of LLMs cites this paper.

Transforming External Knowledge into Triplets for Enhanced Retrieval in RAG of LLMs TheoremQA: A Theorem-driven Question Answering dataset

Reference 8

Resolution
verified exact
arxiv_id, observed 2026-05-11T09:56:05.518220Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-05-10T15:42:59.063869Z digest=sha256:e1b3ec0ed5a4986c7d993dc31d2ff0e2d381f1ebfaa454a2cbc52789f33d6099

Observation 0d0eb227-86e3-4549-a74b-8c292997a0ab · inbound

GRPO-VPS: Enhancing Group Relative Policy Optimization with Verifiable Process Supervision for Effective Reasoning cites this paper.

GRPO-VPS: Enhancing Group Relative Policy Optimization with Verifiable Process Supervision for Effective Reasoning TheoremQA: A Theorem-driven Question Answering dataset

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-05-10T00:14:46.361796Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-05-10T00:14:29.531510Z digest=sha256:5b8ecd2d4969f0f62817594150e7e8c398b4ae9dbfe97ef557725d2c7e659e49

Observation 9023fc29-e263-4504-b6c1-533bad79485e · inbound

OPT-BENCH: Evaluating the Iterative Self-Optimization of LLM Agents in Large-Scale Search Spaces cites this paper.

OPT-BENCH: Evaluating the Iterative Self-Optimization of LLM Agents in Large-Scale Search Spaces TheoremQA: A Theorem-driven Question Answering dataset

Reference 83

Resolution
metadata mismatch
arxiv_id, observed 2026-05-12T03:01:18.568730Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=arxiv_source observed=2026-05-12T02:57:15.521594Z digest=sha256:bb8f4db131fa6bbd6f066a8b08d0471e793ab36ed165101dce5cba9a8841f065

Observation c8ce4cd7-db9d-439b-940a-9042190d010f · inbound

Re$^2$Math: Benchmarking Theorem Retrieval in Research-Level Mathematics cites this paper.

Re$^2$Math: Benchmarking Theorem Retrieval in Research-Level Mathematics TheoremQA: A Theorem-driven Question Answering dataset

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-05-12T02:11:16.053978Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-05-12T02:07:39.648269Z digest=sha256:1b622e43f605dc5c7293af34d998d831d336504ef7aea5840d6adfce9a97c78d

Observation 92230905-ca36-4c93-b155-946231accca7 · inbound

FIND: Toward Multimodal Financial Reasoning and Question Answering for Indic Languages cites this paper.

FIND: Toward Multimodal Financial Reasoning and Question Answering for Indic Languages TheoremQA: A Theorem-driven Question Answering dataset

Reference 1

Resolution
verified exact
arxiv_id, observed 2026-05-14T20:42:58.871798Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-05-14T20:24:46.503457Z digest=sha256:c9084983ff6849dd2cc9b5fff594c521d296a463568b9c5df11593e9a35faa12

Observation 4abd39e9-1b89-4c49-95e0-aafdeeff64b6 · inbound

DRIFT: Decoupled Rollouts and Importance-Weighted Fine-Tuning for Efficient Multi-Turn Optimization cites this paper.

DRIFT: Decoupled Rollouts and Importance-Weighted Fine-Tuning for Efficient Multi-Turn Optimization TheoremQA: A Theorem-driven Question Answering dataset

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-06-29T00:02:50.300057Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-06-28T23:16:49.358792Z digest=sha256:5e2295fa699da1bc737aab75204fb3b9c412aa04df72d480e567e164c3f5810a

Observation e27ac166-aa33-4c50-a297-6849f3dd9cca · inbound

EEVEE: Towards Test-time Prompt Learning in the Real World for Self-Improving Agents cites this paper.

EEVEE: Towards Test-time Prompt Learning in the Real World for Self-Improving Agents TheoremQA: A Theorem-driven Question Answering dataset

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-07-03T04:47:38.824816Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.

source=pdf_text observed=2026-06-27T13:34:32.750618Z digest=sha256:ddc0ed3c9310b3738cd2f5b2bfada2f85abf3fe46136ec2999b74ce18b319a55

Observation b03d169c-a3c8-4fdc-b97e-0aa2679f2167 · inbound

Structured Thoughts For Improved Reasoning And Context Pruning cites this paper.

Structured Thoughts For Improved Reasoning And Context Pruning TheoremQA: A Theorem-driven Question Answering dataset

Reference 59

Resolution
unresolved
no resolver link, observed 2026-07-14T12:08:05.502310Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-14T12:08:05.502310Z digest=sha256:9e1cbe62523c1f86b66fc9aada2e7547309116547cf03a6000c859288687f22e