Pith. sign in

Paper Citation Record · LEDGER

Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2502.19655.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.19655 v1

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 14 of 14 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 14 of 14 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T12:40:13.760606Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-07-03T09:37:49.467682Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation c42987b4-5995-4040-8344-5dd7c2152bac · inbound

Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning cites this paper.

Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-07T12:40:13.760606Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:40:13.760606Z digest=sha256:6d79e4462deb8dd3b0d6dd05820c1d090249ef90334d32a8ce6260c6dee1e681

Observation a652ec66-449a-4c3f-b792-6bd0b635ab19 · inbound

Reasoning Like an Economist: Post-Training on Economic Problems Induces Strategic Generalization in LLMs cites this paper.

Reasoning Like an Economist: Post-Training on Economic Problems Induces Strategic Generalization in LLMs Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 100

Resolution
unresolved
no resolver link, observed 2026-08-07T12:06:31.530153Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:06:31.530153Z digest=sha256:787b6af967a76bfa63d33dc17e3a073aae7f006fb7057cd6fa4b1ed806cc560c

Observation 6e31e4cb-653f-425f-867c-c7a1b88411bb · inbound

Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning cites this paper.

Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-07T00:59:14.911209Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T00:59:14.911209Z digest=sha256:52dcc031a9b53b38d076f2d60a5d0529f8b12cf32fa824a39b987a3a5fdd90bb

Observation ffb13532-71c1-4418-b679-f952e7921f18 · inbound

Can Large Language Models Develop Strategic Reasoning? Post-training Insights from Learning Chess cites this paper.

Can Large Language Models Develop Strategic Reasoning? Post-training Insights from Learning Chess Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T21:13:15.388077Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T21:13:15.388077Z digest=sha256:360ec07b500b05fb5962bcfc16d88ac74c381e5e09aec30935e931a51145b264

Observation 39423670-f1cb-4fb5-af7b-ddafd6882551 · inbound

Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains cites this paper.

Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 38

Resolution
verified exact
arxiv_id, observed 2026-05-13T06:07:56.743850Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-13T06:07:56.678339Z digest=sha256:f2d46b8fe05b6719541c7f320d6f367f8650c4392285bfdf31dd3c7dfd230efb

Observation fae2cfa5-dc85-4e59-a708-6dc70bd8bd9e · inbound

Improving Clinical Diagnosis with Counterfactual Multi-Agent Reasoning cites this paper.

Improving Clinical Diagnosis with Counterfactual Multi-Agent Reasoning Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-05-14T21:48:01.014888Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-14T21:43:57.227448Z digest=sha256:ef1ccb6c774aebc91082f57d3048ba205e5a5bc17d11f685455ea0d441dd410a

Observation 844f0551-f1df-44e5-a7ac-ffae15b22318 · inbound

HEALing Entropy Collapse: Enhancing Exploration in Few-Shot RLVR via Hybrid-Domain Entropy Dynamics Alignment cites this paper.

HEALing Entropy Collapse: Enhancing Exploration in Few-Shot RLVR via Hybrid-Domain Entropy Dynamics Alignment Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 16

Resolution
metadata mismatch
arxiv_id, observed 2026-05-10T05:25:55.233693Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-05-10T05:23:08.478393Z digest=sha256:c00e714e3d1eca20918c8a703fa7d98c62666a4d2401b46f24ee479422b4c8a7

Observation 7fbfb720-98f4-4ec8-bd0b-e969e9f1c4ce · inbound

Infection-Reasoner: A Compact Vision-Language Model for Wound Infection Classification with Evidence-Grounded Clinical Reasoning cites this paper.

Infection-Reasoner: A Compact Vision-Language Model for Wound Infection Classification with Evidence-Grounded Clinical Reasoning Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 73

Resolution
verified exact
arxiv_id, observed 2026-05-11T12:41:04.555986Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-05-10T03:14:24.453124Z digest=sha256:78cf6db71faceb45e7d853934aaa10405c080dae2dcfd0e5458c39040ea0174e

Observation 69eea653-d525-4e1f-a899-375d3dba0ff2 · inbound

Trading Human Curation for Synthetic Augmentation in RLVR cites this paper.

Trading Human Curation for Synthetic Augmentation in RLVR Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-07-02T02:16:26.244087Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-06-28T11:10:06.685591Z digest=sha256:f151284fa90341fde9b84caa7bfb0f5f7d188b7817b1907ec2bf97507809b2fa

Observation c852ef3a-64f4-4b93-9d07-7e3d0d3af1e2 · inbound

Trading Human Curation for Synthetic Augmentation in RLVR cites this paper.

Trading Human Curation for Synthetic Augmentation in RLVR Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 3

Resolution
unresolved
no resolver link, observed 2026-07-12T15:15:09.675778Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T15:15:09.675778Z digest=sha256:294f8d8d387e86fe221e7ea45a9c6e829fd4460ebeaec4b8a30d295ee8598622

Observation a01e5c97-897d-4745-b21a-005c90b00d54 · inbound

UniReason-Med: A Shared Grounded Reasoning Interface for 2D-to-3D Transfer in Medical VQA cites this paper.

UniReason-Med: A Shared Grounded Reasoning Interface for 2D-to-3D Transfer in Medical VQA Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 188

Resolution
metadata mismatch
arxiv_id, observed 2026-07-03T09:37:49.469685Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=arxiv_source observed=2026-06-27T10:21:12.782864Z digest=sha256:5560d3dfe4deffc75fc604f591829f036946fcecc152677f332ddc3eba2a6125

Observation 05f53fe7-fe43-41b2-9806-d4c88f35f8ed · inbound

RareDxR1: Autonomous Medical Reasoning for Rare Disease Diagnosis Beyond Human Annotation cites this paper.

RareDxR1: Autonomous Medical Reasoning for Rare Disease Diagnosis Beyond Human Annotation Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 25

Resolution
verified exact
arxiv_id, observed 2026-07-02T19:27:18.599145Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-07-02T19:21:44.653877Z digest=sha256:1d9b8d01f5f17a28271e9344171b9070807c8627d10ed4c3b7f5094ece20d45d

Observation a8d7a5e0-c434-4fb1-9081-16583889b8ee · inbound

Reasoning Before Translation: Enhancing Legal Machine Translation with Structured Reasoning cites this paper.

Reasoning Before Translation: Enhancing Legal Machine Translation with Structured Reasoning Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-01T13:15:36.924621Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T13:15:36.924621Z digest=sha256:67162251faa2f6ef226030ab42baacc5c93c52ea8c9c6ab80b66993f5ae6073f

Observation e7343383-98f1-4d00-b927-6cada4c19ec4 · inbound

MedUPS: Towards Diagnostic Assistance in Uncommon Medical Cases with Large Language Models cites this paper.

MedUPS: Towards Diagnostic Assistance in Uncommon Medical Cases with Large Language Models Med-RLVR: Emerging Medical Reasoning from a 3B base model via reinforcement Learning

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T00:39:15.161788Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T00:39:15.161788Z digest=sha256:0264dc4f278dd544231f27e4bace7bcf3fd1f1b7947f35321f5d23868d828f5a