Pith. sign in

Paper Citation Record · LEDGER

Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2502.19655.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.19655 v1

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 14 of 14 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 14 of 14 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T12:40:13.760606Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-03T09:37:49.467682Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation c42987b4-5995-4040-8344-5dd7c2152bac · inbound

Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning cites this paper.

Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-07T12:40:13.760606Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:40:13.760606Z digest=sha256:8ac0631850771811827aefba49a245574ea427db54d31be779028739027b5f55

Observation a652ec66-449a-4c3f-b792-6bd0b635ab19 · inbound

Reasoning Like an Economist: Post-Training on Economic Problems Induces Strategic Generalization in LLMs cites this paper.

Reasoning Like an Economist: Post-Training on Economic Problems Induces Strategic Generalization in LLMs Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 100

Resolution
unresolved
no resolver link, observed 2026-08-07T12:06:31.530153Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:06:31.530153Z digest=sha256:787b6af967a76bfa63d33dc17e3a073aae7f006fb7057cd6fa4b1ed806cc560c

Observation 6e31e4cb-653f-425f-867c-c7a1b88411bb · inbound

Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning cites this paper.

Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-07T00:59:14.911209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T00:59:14.911209Z digest=sha256:52dcc031a9b53b38d076f2d60a5d0529f8b12cf32fa824a39b987a3a5fdd90bb

Observation ffb13532-71c1-4418-b679-f952e7921f18 · inbound

Can Large Language Models Develop Strategic Reasoning? Post-training Insights from Learning Chess cites this paper.

Can Large Language Models Develop Strategic Reasoning? Post-training Insights from Learning Chess Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T21:13:15.388077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T21:13:15.388077Z digest=sha256:d04b2f1d294969c893a18802ff867bf414709edd04e12bbb0aa9e11e868daa1c

Observation 39423670-f1cb-4fb5-af7b-ddafd6882551 · inbound

Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains cites this paper.

Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 38

Resolution
verified exact
arxiv_id, observed 2026-05-13T06:07:56.743850Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-13T06:07:56.678339Z digest=sha256:08c68fdfd6cd03ab3fa65624be4ad7d49a82c1f3cf338c5bd39b9ce281b83500

Observation fae2cfa5-dc85-4e59-a708-6dc70bd8bd9e · inbound

Improving Clinical Diagnosis with Counterfactual Multi-Agent Reasoning cites this paper.

Improving Clinical Diagnosis with Counterfactual Multi-Agent Reasoning Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-05-14T21:48:01.014888Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-14T21:43:57.227448Z digest=sha256:a7288f951d9f15018bb8d14679a9baad9c2d2e86e87611fb6db9be2caca6c18e

Observation 844f0551-f1df-44e5-a7ac-ffae15b22318 · inbound

HEALing Entropy Collapse: Enhancing Exploration in Few-Shot RLVR via Hybrid-Domain Entropy Dynamics Alignment cites this paper.

HEALing Entropy Collapse: Enhancing Exploration in Few-Shot RLVR via Hybrid-Domain Entropy Dynamics Alignment Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 16

Resolution
metadata mismatch
arxiv_id, observed 2026-05-10T05:25:55.233693Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-05-10T05:23:08.478393Z digest=sha256:8f088e6b29274e1fbf8f6d66a0813d608616ea1043176c4a423f3f0a281e9b89

Observation 7fbfb720-98f4-4ec8-bd0b-e969e9f1c4ce · inbound

Infection-Reasoner: A Compact Vision-Language Model for Wound Infection Classification with Evidence-Grounded Clinical Reasoning cites this paper.

Infection-Reasoner: A Compact Vision-Language Model for Wound Infection Classification with Evidence-Grounded Clinical Reasoning Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 73

Resolution
verified exact
arxiv_id, observed 2026-05-11T12:41:04.555986Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-10T03:14:24.453124Z digest=sha256:4e99f3f0204c67d8c6a0f7082df01951786e3c07e7643a0cfe6af99d4018358b

Observation 69eea653-d525-4e1f-a899-375d3dba0ff2 · inbound

Trading Human Curation for Synthetic Augmentation in RLVR cites this paper.

Trading Human Curation for Synthetic Augmentation in RLVR Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-07-02T02:16:26.244087Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-06-28T11:10:06.685591Z digest=sha256:4a1ec85218817d5311e46ad3baaef7ae683d4b5d0e2feeba16fdf8a57a0007cb

Observation c852ef3a-64f4-4b93-9d07-7e3d0d3af1e2 · inbound

Trading Human Curation for Synthetic Augmentation in RLVR cites this paper.

Trading Human Curation for Synthetic Augmentation in RLVR Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 3

Resolution
unresolved
no resolver link, observed 2026-07-12T15:15:09.675778Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T15:15:09.675778Z digest=sha256:d0b397510bb5c74464ddb6b63a9452b09f8322def8104b71a885f4b011afd929

Observation a01e5c97-897d-4745-b21a-005c90b00d54 · inbound

UniReason-Med: A Shared Grounded Reasoning Interface for 2D-to-3D Transfer in Medical VQA cites this paper.

UniReason-Med: A Shared Grounded Reasoning Interface for 2D-to-3D Transfer in Medical VQA Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 188

Resolution
metadata mismatch
arxiv_id, observed 2026-07-03T09:37:49.469685Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-06-27T10:21:12.782864Z digest=sha256:cd2f32c9ca56ddf9abe4c52ac6f1a368cf43fb075d599cb9d5feb61875c29069

Observation 05f53fe7-fe43-41b2-9806-d4c88f35f8ed · inbound

RareDxR1: Autonomous Medical Reasoning for Rare Disease Diagnosis Beyond Human Annotation cites this paper.

RareDxR1: Autonomous Medical Reasoning for Rare Disease Diagnosis Beyond Human Annotation Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 25

Resolution
verified exact
arxiv_id, observed 2026-07-02T19:27:18.599145Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-07-02T19:21:44.653877Z digest=sha256:a92ccac5fb020d895540ca4638dbb97551e2e8f0a11f8ba226c8be051ca1e4d3

Observation a8d7a5e0-c434-4fb1-9081-16583889b8ee · inbound

Reasoning Before Translation: Enhancing Legal Machine Translation with Structured Reasoning cites this paper.

Reasoning Before Translation: Enhancing Legal Machine Translation with Structured Reasoning Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-01T13:15:36.924621Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T13:15:36.924621Z digest=sha256:67162251faa2f6ef226030ab42baacc5c93c52ea8c9c6ab80b66993f5ae6073f

Observation e7343383-98f1-4d00-b927-6cada4c19ec4 · inbound

MedUPS: Towards Diagnostic Assistance in Uncommon Medical Cases with Large Language Models cites this paper.

MedUPS: Towards Diagnostic Assistance in Uncommon Medical Cases with Large Language Models Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T00:39:15.161788Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T00:39:15.161788Z digest=sha256:0264dc4f278dd544231f27e4bace7bcf3fd1f1b7947f35321f5d23868d828f5a